2026年 Kimi API 定价:方案与成本指南
Compare Moonshot Kimi API pricing across 5 models. Pay-as-you-go rates from ¥12–¥60 per MTok. Free tier, rate limits, and cost calculation guide inclu...
Moonshot Kimi API 是 Moonshot AI 提供的按量计费大语言模型 API。该 API 共有五种模型,其上下文窗口介于 8K 至 128K token 之间,并按每百万 token 进行计费。下表显示了所有模型的当前定价,以人民币 (CNY) 和美元概算金额表示。
| 模型 | 上下文窗口 | 输入 (每 MTok, CNY) | 输入 (每 MTok, USD*) | 输出 (每 MTok, CNY) | 输出 (每 MTok, USD*) | 最适合 |
|---|---|---|---|---|---|---|
moonshot-v1-8k | 8,192 令牌 | ¥12 CNY | ~$1.65 | ¥12 CNY | ~$1.65 | 做空 问答, 分类 |
moonshot-v1-32k | 32,768 令牌 | ¥24 CNY | ~$3.30 | ¥24 CNY | ~$3.30 | 多轮对话, 文档 |
moonshot-v1-128k | 131,072 令牌 | ¥60 CNY | ~$8.25 | ¥60 CNY | ~$8.25 | 完整文档, 合约 |
| Kimi k1.5 | 128,000 令牌 | 请在 平台.moonshot.cn 验证 | n/a | 请在 平台.moonshot.cn 验证 | n/a | 复杂推理, 数学 |
| Kimi VL | 128,000 令牌 | 请在 平台.moonshot.cn 验证 | n/a | 请在 平台.moonshot.cn 验证 | n/a | 图像分析, OCR |
美元价格仅为近似换算,供参考。Kimi API 的官方定价以人民币(CNY)为单位,可在平台 platform.moonshot.cn 查看。实际美元费用将取决于您的支付处理商的汇率。
⚠️ 价格截至 2025 年 6 月已核实。Kimi API 的定价经常变动。请务必在进行预算之前,于 平台.moonshot.cn/pricing 的 Moonshot AI API 定价页面确认当前费率。
最后更新:2025年6月
本页内容:
- 什么是 Moonshot Kimi API?
- Kimi API 模型与定价 (2026)
- Kimi API 免费套餐:免费可享内容
- 各套餐的速率限制
- 如何计算您的 Kimi API 费用
- Kimi API 与竞争对手:价格比较
- 如何降低您的 Kimi API 费用
- 企业和批量定价
- Kimi API 是否在中国境外可用?
- 如何开始使用 Kimi API
- 常见问题解答
什么是 Moonshot Kimi API?
Moonshot AI(月之暗面)是一家总部位于北京的 AI 初创公司,成立于 2023 年。据报道,该公司到 2024 年已筹集了超过 10 亿美元的资金,致力于将自己定位为 OpenAI 和 Google 在大语言模型领域的中国竞争对手。该公司的开发者产品是位于 platform.moonshot.cn 的 Kimi API,这是一款与 kimi.ai 上的消费者聊天机器人相互独立的产品。本指南仅涵盖开发者 API。
Kimi API 采用与 OpenAI 兼容的 REST 格式,这意味着大多数 OpenAI SDK 示例只需极少的改动即可配合 Kimi 使用。这为已经在 GPT-4o 上运行的开发者提供了一条切实可行的迁移路径。
Token: LLM API 计费的文本基本单位。在英文中,1 个 Token ≈ 0.75 个单词,因此 1,000 个单词 ≈ 1,333 个 Token。您发送给模型的 Token(输入 Token)和模型响应中的 Token(输出 Token)都会被分别计量和计费。
上下文窗口是指模型在单次 API 调用中可处理的最大 Token 数量,包括输入和输出的总和。moonshot-v1-128k 模型支持 128K Token,大约相当于 96,000 个英文单词,或一部完整小说的篇幅,都可以在一次调用中处理。
Kimi 采用按量计费的计费模式,无需强制按月订阅。您只需为您消耗的代币付费,且不设固定的平台费用。
Bybit 上的 MOONSHOT 代币: Moonshot AI 在前沿人工智能领域的扩张吸引了加密货币交易者的关注 —— Bybit 为有兴趣交易 MOONSHOT 代币的人士提供 MOONSHOTUSDT 永续合约)。另请参阅 Bybit 上的 Moonshot AI IPO 交易机会.)
Kimi API 模型与定价 (2026)
Moonshot 通过 Kimi API 提供五种模型:三种根据上下文窗口大小区分的标准对话模型、一种推理模型,以及一种视觉语言模型。
| 模型 | 类型 | 上下文窗口 | 价格范围(每百万 tokens, 人民币) | 最佳用途 |
|---|---|---|---|---|
moonshot-v1-8k | 聊天 | 8,192 tokens | ¥12 人民币 | 做空 任务,分类 |
moonshot-v1-32k | 聊天 | 32,768 tokens | ¥24 人民币 | 对话,中型文档 |
moonshot-v1-128k | 聊天 | 131,072 tokens | ¥60 人民币 | 整篇文档,法律,大型代码库 |
| Kimi k1.5 | 推理 | 128,000 tokens | 请查阅文档 | 复杂推理,数学,编码 |
| Kimi VL | 视觉-语言 | 128,000 tokens | 请查阅文档 | 图像分析,OCR,视觉问答 |
💡 总成本 = (输入Token数量 × 每百万Token价格) + (输出Token数量 × 每百万Token价格)
输入 Tokens 是您发送给模型的消息中的 Tokens:您的系统提示、用户消息和任何对话历史。输出 Tokens 是模型生成的响应中的 Tokens。Kimi 在 moonshot-v1 系列中对输入和输出 Tokens 定价相同,这与 OpenAI 和 Anthropic 不同,它们的输出 Tokens 成本是输入 Tokens 的 3-5 倍。这种对称性使得 Kimi 的计费更容易估算,对于生成长响应的应用程序尤其如此。
对于聊天机器人,输入 Token 数会随着每一轮对话历史的增加而增长。对于文档摘要,相对于您发送的大量输入,输出成本较低。请据此规划您的 Token 预算。
流式响应不影响计费。无论是否启用流式传输,计费 Token 均相同。
ℹ️ 所有人民币价格均为官方Moonshot定价。表格中显示的美元价格为近似换算。官方定价以人民币(CNY)计价,在 platform.moonshot.cn。任何每百万Token(per-MTok)的价格除以1,000即可得到每1K Token的费率。
Kimi API 采用即用即付(pay-as-you-go)的定价模式,不设月度订阅计划。没有固定的分级费用,你按使用量付费。### moonshot-v1-8k
moonshot-v1-8k 是成本最低的 Kimi 模型,拥有 8,192 token 的上下文窗口,适用于不需要长上下文的简短问答、分类任务和单轮聊天机器人响应。
| 输入 (每 MTok) | 输出 (每 MTok) | |
|---|---|---|
| CNY | ¥12 CNY | ¥12 CNY |
| USD* | ~$1.65 | ~$1.65 |
“8k” 后缀表示的是 token 数量的上下文窗口大小,而不是版本或质量等级。当您的提示和响应能够舒适地容纳 8,192 个 token,并且您想要最低的每 token 费率时,请使用此模型。
最适合: 单轮问答、意图分类、短文本生成、具有简短交流的客户服务机器人。
moonshot-v1-32k
moonshot-v1-32k 提供 32,768 个 token 的上下文窗口,这足以支持多轮对话、中等长度的文档审查以及大多数代码审查任务,而无需支付 128K 模型全部的权利金。
| Input (per MTok) | Output (per MTok) | |
|---|---|---|
| CNY | ¥24 CNY | ¥24 CNY |
| USD* | ~$3.30 | ~$3.30 |
当您的使用场景超出 8K 上下文,但又无需在单次调用中处理完整的长篇文档时,请选择此模型。
最适用于: 多轮对话、代码审查、中等长度文档、带有上下文的邮件草拟。
moonshot-v1-128k
moonshot-v1-128k 支持 131,072 token 的上下文窗口,相当于约 96,000 字,或一本完整小说的长度。它是 Kimi 进行全文分析、法律合同审查和大型代码库处理的首选模型。每 MTok 价格为 60 元人民币(约 8.25 美元),在相同的 128K 上下文窗口大小下,此模型比 GPT-4o 便宜得多。
| 输入 (每 MTok) | 输出 (每 MTok) | |
|---|---|---|
| 人民币 | ¥60 CNY | ¥60 CNY |
| 美元* | ~$8.25 | ~$8.25 |
这是大多数开发者在将Kimi与OpenAI的长上下文工作负载进行比较时会引用的模型。128K的容量单次调用即可覆盖约300页的技术文档。
最适合: 全文文档分析、法律合约审查、研究论文摘要、大型代码库处理、长篇书籍文本分析。
Kimi k1.5(推理模型)
Kimi k1.5 是一个独立的、专注于推理的模型,并非 moonshot-v1 系列的更大版本。它专为思维链任务而设计,包括复杂的数学问题、多步骤编码挑战以及研究分析。像 Kimi k1.5 这样的推理模型在扩展思维能力领域直接与 OpenAI o1/o3 和 DeepSeek-R1 竞争。
在预算制定前,应在 platform.moonshot.cn/docs 核实 Kimi k1.5 的定价。这是因为推理模型通常由于内部思维链处理所需的额外计算资源,其每代币费率比标准聊天模型更高。一些推理模型还会对“思考代币”单独收费。请在当前文档中确认 Kimi k1.5 是否适用此情况。
最适用于:复杂多步推理、高等数学、高难度编程挑战,以及需要逻辑链的研究综合。
欲了解 Kimi K3 的功能和基准的全面技术评测,请参阅 Kimi K3:Moonshot AI 的旗舰推理模型.
Kimi VL (视觉-语言模型)
Kimi VL 在单次 API 调用中同时支持图像和文本输入,其中文本代币(tokens)按每百万代币(MTok)计价,图像输入则根据分辨率单独计价。这是 Moonshot 推出的多模态视觉模型,适用于需要同时读取图像和文本的任务。
Kimi VL 的图像定价通常遵循按图块或按图像计费的方法,较高分辨率的图像会消耗更多 token。在构建基于视觉的应用程序之前,请在 platform.moonshot.cn/docs 验证当前的图像定价方法,因为图像 token 的费率与文本 token 的费率不同。
最适用于: 文档 OCR、图像分析、视觉问答、图表解读、截图转文字提取。
⚠️ 价格截至 2025 年 6 月已核实。所有价格可能会有所变动。请在制定预算前,在 platform.moonshot.cn 平台进行确认。
Kimi API 免费套餐:免费获得什么
✅ 免费版摘要: 新账户在注册后将获得约 ¥15 人民币的免费 API 额度。额度将在一定期限后过期(由于条款可能会变动,请在注册前到 platform.moonshot.cn 核实当前的过期日期)。适用免费版速率限制。所有
moonshot-v1模型均可使用免费额度访问。
Moonshot 会在用户注册时向新账户分配免费试用额度。这只是一次性的额度分配,并非SaaS意义上的限时免费试用。你获得的是一个固定的信用额度余额,用于API调用,而不是30天的无限访问权限。
以 moonshot-v1-8k 每百万代币 (MTok) ¥12 人民币的价格计算,¥15 人民币的免费额度大约可涵盖 125 万个输入或输出代币。这足以在提交任何支付详情之前,进行数百次测试请求并初步完成基础集成的原型设计。
免费套餐的速率限制适用于测试和原型开发,但不适用于生产流量。如果您需要更高的吞吐量,则需要充值积分并升级到付费套餐。免费套餐适用于所有三个 moonshot-v1 模型,因此您可以使用您的免费积分测试 8K、32K 和 128K 的变体,以便在选择模型前比较输出质量。
领取您的免费奖励:
- 在 platform.moonshot.cn 注册
- 验证您的电子邮件或手机号码
- 验证完成后,免费奖励将自动发放到您的账户
在 platform.moonshot.cn 领取您的免费 Kimi API 额度。
各等级频率限制
速率限制控制您可以调用 Kimi API 的速度,以**RPM(每分钟请求数)和TPM(每分钟令牌数)**为单位衡量。它们控制的是调用速度,而不是总月度用量。
| 账户等级 | RPM (每分钟请求数) | TPM (每分钟 Token 数) | 备注 |
|---|---|---|---|
| 免费级 | 3 RPM | 32,000 TPM | 仅限测试与原型开发 |
| 标准付费 (第 1 级) | 60 RPM | 200,000 TPM | 适用于低流量生产环境 |
| 标准付费 (第 2 级) | 300 RPM | 1,000,000 TPM | 中等规模生产工作负载 |
| 高额消费 / 企业级 | 自定义 | 自定义 | 联系 Moonshot 获取专属限额 |
在构建生产应用程序之前,请在 platform.moonshot.cn/docs 处验证当前的速率限制值。速率限制的层级和阈值会随着 Moonshot 更新其平台而改变。
限额通常会随着您账户累计支出的增长而提高。Moonshot 将更高的限额与消费历史挂钩。在平台上的消费更多的账户,将逐步获得更高的 RPM 和 TPM 分配,而无需单独升级计划。
⚠️ 超出速率限制将返回 HTTP 429 Too Many Requests 错误。请在您的应用程序中实现指数退避重试逻辑,以优雅地处理速率限制响应。从 1 秒延迟开始,并在每次后续重试时加倍,直至达到最大等待时间。
如需申请超出您当前等级的额度提升,请通过平台控制面板 (platform.moonshot.cn) 或通过下方“企业与大宗定价”部分所述的企业咨询渠道联系 Moonshot 支持。
速率限制不同于支出限额。速率限制规定了您可以进行调用的速度,而不是您可以花费的总信用余额。预先充值特定的信用余额是控制总支出的主要机制。
如何计算您的 Kimi API 费用
💡 总成本 = (输入Token数量 × 每百万Token价格) + (输出Token数量 × 每百万Token价格)
输入 Token 是指您发送给模型的消息中的 Token。输出 Token 是指模型回复中的 Token。两者将分开计量,并按照上方价格表中的费率计费。在 moonshot-v1 系列中,输入和输出的定价相同,因此公式简化为:总 Token 数 × 每百万 Token (MTok) 价格。
单词与代币转换参考:
| 英文词汇 | 近似标记数量 |
|---|---|
| 500 词 | ~667 标记 |
| 1,000 词 | ~1,333 标记 |
| 2,000 词 | ~2,667 标记 |
| 5,000 词 | ~6,667 标记 |
要计算您的月度成本,请遵循以下步骤:
- 估算您每次请求的平均输入 Token(系统提示 + 用户消息 + 历史记录)。
- 估算您每次请求的平均输出 Token(模型响应长度)。
- 将输入和输出 Token 相加,得到每次请求的总 Token 数。
- 乘以您每天的请求次数,以计算每日 Token 消耗量。
- 应用所选模型的每百万 Token (MTok) 费率:总 Token 数 ÷ 1,000,000 × 每 MTok 价格。
- 乘以 30 以获得每月估算费用。
请参考此表格,根据字数估算您的输入大小。如需在调用前进行更精确的 Token 计数,请使用 OpenAI tiktoken (github.com/openai/tiktoken) 作为参考。Kimi 的分词器可能略有不同,请查阅 platform.moonshot.cn/docs 以获取 Moonshot 的官方分词器端点。
实际案例 A:聊天机器人(中等流量)
场景: 一个客服聊天机器人每天处理 1,000 次查询,每次查询包含 800 个输入 token 和 400 个输出 token。模型:moonshot-v1-8k。
- 每日输入 Token:1,000 × 800 = 800,000 Token = 0.8 MTok
- 每日输出 Token:1,000 × 400 = 400,000 Token = 0.4 MTok
- 每日总计:1.2 MTok × ¥12 CNY = ¥14.40 CNY/日(约 $1.98 USD/日)
- 每月成本:约 ¥432 CNY(约 $59 USD)
示例 B:文档摘要生成器(低用量)
场景: 研究工具每天处理 100 份文档,每份文档包含 10,000 个输入 token 和 500 个输出 token。模型:moonshot-v1-128k (适用于处理长文档)。
- 每日输入令牌:100 × 10,000 = 1,000,000 令牌 = 1 MTok
- 每日输出令牌:100 × 500 = 50,000 令牌 = 0.05 MTok
- 每日总计:1.05 MTok × ¥60 人民币/日 = ¥63 人民币/日 (~8.67 美元/日)
- 每月费用:~¥1,890 人民币 (~260 美元)
案例 C:代码助手(中等用量)
场景: 开发者工具每天发送 500 次请求,每次包含 2,000 个输入 token 和 800 个输出 token。模型:moonshot-v1-32k。
- 每日输入代币:500 × 2,000 = 1,000,000 代币 = 1 MTok
- 每日输出代币:500 × 800 = 400,000 代币 = 0.4 MTok
- 每日总计:1.4 MTok × ¥24 CNY = ¥33.60 CNY/天 (~$4.62 USD/天)
- 每月成本:~¥1,008 CNY (~$139 USD)
Kimi 的计费采用信用额度预付模式。您需为账户余额充值,API 调用将从中扣除费用。如需持续追踪成本,请使用 Artificial Analysis (artificialanalysis.ai) 参考最新的美元定价,将 Kimi 与其他供应商进行基准对比。
Kimi API 与竞争对手:价格对比
下表对比了截至 2025 年 6 月,Kimi API 与 OpenAI、DeepSeek、Anthropic 和 Google Gemini 的价格,所有数值均以每百万 Token 的美元(USD)为单位。
| 提供商 | 模型 | 输入 (每百万 Token, 美元) | 输出 (每百万 Token, 美元) | 上下文窗口 | 备注 |
|---|---|---|---|---|---|
| Moonshot Kimi | moonshot-v1-8k | ~$1.65 | ~$1.65 | 8K | 最低价 Kimi |
| Moonshot Kimi | moonshot-v1-32k | ~$3.30 | ~$3.30 | 32K | 中端 |
| Moonshot Kimi | moonshot-v1-128k | ~$8.25 | ~$8.25 | 128K | 旗舰长上下文 |
| OpenAI | GPT-4o | $2.50 | $10.00 | 128K | 请在 platform.openai.com 的 OpenAI 定价页面进行验证 |
| OpenAI | GPT-4o mini | $0.15 | $0.60 | 128K | 请在 platform.openai.com 的 OpenAI 定价页面进行验证 |
| DeepSeek | DeepSeek-V3 | $0.27 | $1.10 | 64K | 请在 platform.deepseek.com 的 DeepSeek 定价页面进行验证 |
| Anthropic | Claude 3.5 Sonnet | $3.00 | $15.00 | 200K | 请在 anthropic.com/pricing 的 Anthropic 定价页面进行验证 |
| Gemini 1.5 Pro | $1.25 | $5.00 | 100万 Token | 请在 ai.google.dev/pricing 的 Google AI 定价页面进行验证 |
⚠️ 所有价格已于 2025 年 6 月核实。LLM 提供商的定价变动频繁。在做出供应商决策前,请务必前往官方文档页面核实所有价格。
Kimi 的 moonshot-v1-128k 模型在输入和输出方面的费用均为每 MTok 约 8.25 美元,而 GPT-4o 在相同 128K 上下文窗口下的费用为每 MTok 输入 2.50 美元 / 输出 10.00 美元。对于生成大量输出的应用,Kimi 显然更具价格优势。
当 Kimi 胜出时: 适用于 128K 的长文本工作负载(此时 GPT-4o 的输出成本变得非常显著),或者输入和输出量对称的应用场景(此时 Kimi 相同的输入/输出定价可简化预算编制)。
当竞争对手可能胜出时: DeepSeek-V3 在每 token 费率上大幅低于 Kimi(输入 0.27 美元,而 Kimi 8K 约为 1.65 美元),用于做空(short-context)任务。Google Gemini 1.5 Pro 提供 1M token 的上下文窗口,每 MTok 费用为 1.25 美元/5.00 美元,更适合处理超过 128K token 的工作负载。Anthropic Claude 3.5 Sonnet 提供 200K 的上下文窗口,并具有强大的推理能力,适合那些需要超出 Kimi 128K 上下文容量的团队。
在中国国内大语言模型生态系统中进行比较的中国开发者,可能也会评估阿里云的通义千问(Qwen),它在处理中文任务方面具有极具竞争力的价格优势。
为了更广泛的模型间比较,包括基准测试和用例契合度,请参阅 Moonshot AI vs DeepSeek vs Qwen:中国AI模型比较.)
如何降低您的 Kimi API 成本
Kimi API 中最大的成本杠杆是模型选择:对于适合 8K 上下文窗口的任务,使用 moonshot-v1-8k 而不是 moonshot-v1-128k,可以将每 token 的支出降低 5 倍。在扩展任何 Kimi 驱动的应用之前,请审阅以下策略。
选择正确的模型层级。 审计您实际的提示和响应长度。如果您的平均请求使用少于 6,000 个 token,
moonshot-v1-8k的价格为 ¥12 CNY/MTok,而不是 ¥60 CNY/MTok。价格差异会随着规模的扩大而累积。截断对话历史。 在多轮聊天机器人应用中,每一轮都重新发送完整的对话历史会累积大量的输入 Token 计数。在上下文窗口中仅保留最近的 3 至 5 次对话,而不是整个会话记录。
**精简您的提示。**从系统提示中移除冗余的指令、重复的上下文和冗长的措辞。一个可从 500 个 token 缩减至 200 个 token 的系统提示,每次请求可节省 300 个 token。每月 100,000 次请求,相当于 3000 万 token 的储蓄。
缓存重复响应。 如果您的应用程序经常发送相同或几乎相同的查询(例如,FAQ机器人、使用相同基本提示的产品描述生成器),请缓存响应,并完全跳过重复输入的 API 调用。
设定支出上限。 在 Kimi 账户余额中预先加载特定的信用额度,而不是启用自动充值。这可以作为硬性支出上限。当余额为零时,API 调用将停止。通过平台.moonshot.cn 仪表板定期检查您的余额。
使用
max_tokens参数。 在您的 API 请求中设置max_tokens以限制输出长度,适用于那些不需要长响应的任务。分类任务、是/否回答以及提取任务通常不需要超过 100-200 个输出 token。在费用账单仪表板中监控使用情况。 在 platform.moonshot.cn 平台仪表板中,按模型和日期查看 Token 消耗量。识别哪些端点消耗的 Token 最多,通常会发现仅凭代码检查难以察觉的优化机会。
企业及批量定价
Moonshot AI 没有公开列出企业或大批量折扣定价。本文中的费率仅反映公开提供的按量计费定价。如需企业合约、专属速率限制或大批量折扣,请通过 platform.moonshot.cn 上的企业咨询表单直接联系 Moonshot AI。
大规模评估 Kimi 的组织通常需要评估:高于标准付费套餐的专用速率限制上限、与每月代币支出挂钩的批量折扣门槛、数据驻留保证和合规性认证、SLA 条款和正常运行时间承诺,以及合同数据处理协议。
截至撰写本文时,这些条款均未公开披露。请勿假设在任何特定的支出门槛下都存在成交量折扣。在根据折扣假设进行财务预测之前,请直接向 Moonshot 的销售团队核实。
Kimi API 在中国以外是否可用?
是的,海外开发者可以通过 platform.moonshot.cn 访问 Kimi API。国际开发者可以按照标准注册流程创建账户并生成 API 密钥,该流程支持使用国际电子邮件地址。
非中国用户注册时应验证付款方式的接受情况。可接受的方式可能包括国际信用卡或第三方支付处理器。在尝试添加账单信息之前,请在 platform.moonshot.cn 上确认支持的支付选项。
国际用户的注册流程与中国用户的流程相同:创建账户,验证您的手机号码或电子邮件,并在仪表板上生成 API 密钥。部分国际手机号码可能无法用于短信验证。如果您遇到这种情况,请使用电子邮件验证或联系 Moonshot 支持。
🔒 数据隐私声明: Moonshot AI 是一家中国公司,其 Kimi API 基础设施在中国法律和数据法规下运行。API 请求数据将在中国境内的 Moonshot AI 服务器上进行处理。处于受监管行业或有数据驻留要求的司法管辖区的开发者,在生产环境中部署 Kimi API 之前,应查阅 platform.moonshot.cn 上的 Moonshot 隐私政策。请勿在未查阅 Moonshot 合规性文档和数据处理协议的情况下,发送受 GDPR、HIPAA 或其他受监管数据框架约束的数据。
对于有合规要求的企业用户而言,缺乏公开记录的数据驻留期权、SOC 2 认证或数据处理协议是一个实质性的考量因素。请将任何合规咨询转交给 Moonshot 的企业团队。但这并不构成在所有用例中都排除使用 Kimi 的理由。许多开发者应用程序处理的是非敏感数据,在这些情况下,中国司法管辖权并不构成合规障碍。关键在于进行审慎的评估,而非凭空假设。
如何开始使用 Kimi API
只需不到五分钟,按照以下步骤即可创建 Kimi API 账户并生成您的第一个 API 密钥。
在平台.moonshot.cn 创建账户。 国际用户可能需要提供手机号码进行短信验证。请准备好一个国际手机号码,或在您所在国家/地区无法进行电话验证时,选择电子邮件注册。
验证您的电子邮件或手机号码。 完成验证步骤,以激活您的账户并解锁免费试用积分。
领取您的免费试用额度。 新账户在通过验证后将自动获得约 ¥15 CNY 的免费额度。请在控制面板查看您的账户余额,以确认额度已到账。
导航至仪表盘中的“API 密钥”。 登录后,便可从主仪表盘菜单访问 API 密钥管理部分。
生成新的 API 密钥并将其复制。 点击“创建 API 密钥”,为其取一个描述性名称,并立即复制该密钥。创建页面关闭后,系统将不再显示完整的密钥。
将API密钥存储为环境变量。 将
MOONSHOT_API_KEY=your_key_here添加到你的.env文件或部署环境的密钥管理器中。切勿将密钥直接硬编码到源文件中,或将其提交到版本控制。查阅 API 文档。Kimi API 使用 OpenAI 兼容的格式。基本 URL 会有所不同,但请求结构与 OpenAI Chat Completions API 完全相同。大多数 OpenAI SDK 示例只需稍作修改即可使用。在 平台.moonshot.cn/docs 访问完整文档。
在 platform.moonshot.cn 获取您的免费 Kimi API 密钥。
常见问题
Kimi API 的费用是多少?
Kimi API 的费用介于 moonshot-v1-8k 模型的每百万 token 12 元人民币(约 1.65 美元)到旗舰级 moonshot-v1-128k 模型的每百万 token 60 元人民币(约 8.25 美元)之间。moonshot-v1 系列的输入和输出 token 定价相同,这与 OpenAI 的定价结构不同,后者输出 token 的费用是输入的 4 倍。所有定价均采用按量计费模式,无需支付强制性的订阅费。
Kimi API 是否提供免费层级?
是的。新账户在 platform.moonshot.cn 平台注册时将获得约 ¥15 CNY 的免费试用额度。这些额度适用于所有 moonshot-v1 模型,允许您在添加支付凭据前进行集成原型测试。免费额度为一次性分配,而非持续的免费层级。一旦消耗完毕,您需要添加付费额度以继续使用。免费层级的速率限制(约 3 RPM)适用于测试,但不适用于生产流量。请参阅上方的 Kimi API 免费层级 部分以获取详细信息。
Kimi API 的最大上下文窗口是多少?
目前公开可用的最大 Kimi API 模型 moonshot-v1-128k 支持 128K token 的上下文窗口,约等于 96,000 个单词或一整本长篇小说。Kimi 还以更低的价格提供 moonshot-v1-8k(8,192 token)和 moonshot-v1-32k(32,768 token)。Moonshot 在研究中展示了 100 万 token 的实验性上下文,但目前尚未通过公开 API 提供。
Kimi API 的价格与 OpenAI GPT-4o 相比如何?
在相当的上下文窗口大小下,特别是针对输出密集型工作负载,Kimi 比 GPT-4o 更便宜。在 128K 上下文时,GPT-4o 的输入成本为每百万代币 $2.50,输出为每百万代币 $10.00,而 Kimi moonshot-v1-128k 的输入和输出费用均为每百万代币约 $8.25。对于生成大量输出的应用,实际的成本差异非常显著。对于输入密集但输出较短的工作负载,GPT-4o mini 的费用为每百万代币 $0.15/$0.60,比任何 Kimi 模型都便宜。请参阅上方的完整价格对比表。
Kimi API 是否在中国境外可用?
是的。Kimi API 可通过 platform.moonshot.cn 平台在全球范围内访问。国际开发者可以通过标准注册流程进行注册、添加支付凭据,并在中国境外使用该 API。数据在 Moonshot AI 位于中国的基础设施上进行处理。受监管行业且有数据驻留要求的开发者在部署到生产环境前,应审阅 Moonshot 的隐私政策。请参阅上方的国际可用性部分以获取完整的隐私声明。
Moonshot Kimi 通过 API 提供哪些模型?
Moonshot 通过 Kimi API 提供五种模型:moonshot-v1-8k(8K 上下文,成本最低)、moonshot-v1-32k(32K 上下文,中等级别)、moonshot-v1-128k(128K 上下文,旗舰)、Kimi k1.5(具备链式思考能力的推理模型,可与 OpenAI o1 媲美)以及 Kimi VL(接受图像和文本输入的视觉语言模型)。每种模型都有单独的定价,moonshot-v1 系列已公开列出,Kimi k1.5/VL 的定价需在 platform.moonshot.cn/docs 进行验证。
如何计算我的 Kimi API 费用?
使用公式:总成本 = (输入 Token 数量 × 每百万个 Token 的输入价格) + (输出 Token 数量 × 每百万个 Token 的输出价格)。例如,在 moonshot-v1-8k 上,一个聊天机器人每次请求发送 800 个输入 Token 并接收 400 个输出 Token,其成本为 (800 × ¥12/1,000,000) + (400 × ¥12/1,000,000) = 每次请求 ¥0.0144 人民币(约合 $0.002 美元)。按每天 1,000 次请求计算,每月总计约为 ¥432 人民币(约合 $59 美元)。有关不同使用规模的完整计算示例,请参阅上方的 如何计算您的 Kimi API 成本 章节。
Kimi API 的频率限制是多少?
速率限制因账户级别而异。免费套餐限制为每分钟约 3 次请求 (RPM) 和每分钟 32,000 个令牌 (TPM),这足以用于测试,但不适用于生产流量。标准的付费套餐提供每分钟 60-300 次请求 (RPM) 和每分钟 200,000-1,000,000 个令牌 (TPM),并根据累计账户支出进行扩展。超出速率限制将返回 HTTP 429 Too Many Requests 错误。有关完整的套餐比较表,请参阅上面的 各级别速率限制 部分。
Kimi API 比 GPT-4 便宜吗?
是的,moonshot-v1-128k 的每 MTok 输入和输出大约为 8.25 美元,远低于 GPT-4o 在等效 128K 上下文窗口下的输出价格 10.00 美元/MTok。对于对称的输入/输出工作负载,节省的成本是可观的。然而,DeepSeek-V3 在短上下文任务上的价格更低(每 MTok 0.27 美元/1.10 美元),而 Google Gemini 1.5 Pro 则为超出 128K 上下文的应用提供了 100 万个 token 的上下文窗口,价格为 1.25 美元/5.00 美元/MTok。Kimi 的价格优势在长上下文、输出密集型工作负载中最为明显,在这些工作负载中,GPT-4o 的输出成本占了账单的大部分。
如何获取 Kimi API 密钥?
在 platform.moonshot.cn 注册账户,验证您的电子邮件或电话号码,前往仪表盘的“API 密钥”部分,并生成新密钥。立即从创建屏幕复制它。将密钥作为环境变量(MOONSHOT_API_KEY)存储在您的项目中。切勿将其硬编码在源代码文件中。新账户在验证后还会自动获得免费试用额度。
Kimi API 的定价将 moonshot-v1-128k 定位为做多上下文工作负载中具有成本竞争力的选择,尤其是在 GPT-4o 或 Claude 大规模使用变得昂贵的情况下,特别适用于受益于 Kimi 相同的输入/输出定价结构的输出密集型应用。
在 platform.moonshot.cn 查看当前的 Kimi API 价格。
最后更新:2025年6月 | 价格来源及验证于平台.moonshot.cn/docs