本文由 AI 生成,请独立核实重要信息。

2026年 Kimi API 定价:方案与成本指南

Crypto Wiki|Aug 11, 2026|4.5 (500 人评分)
AI 摘要

Compare Moonshot Kimi API pricing across 5 models. Pay-as-you-go rates from ¥12–¥60 per MTok. Free tier, rate limits, and cost calculation guide inclu...

Moonshot Kimi API 是 Moonshot AI 提供的按量计费大语言模型 API。该 API 共有五种模型,其上下文窗口介于 8K 至 128K token 之间,并按每百万 token 进行计费。下表显示了所有模型的当前定价,以人民币 (CNY) 和美元概算金额表示。

模型上下文窗口输入 (每 MTok, CNY)输入 (每 MTok, USD*)输出 (每 MTok, CNY)输出 (每 MTok, USD*)最适合
moonshot-v1-8k8,192 令牌¥12 CNY~$1.65¥12 CNY~$1.65做空 问答, 分类
moonshot-v1-32k32,768 令牌¥24 CNY~$3.30¥24 CNY~$3.30多轮对话, 文档
moonshot-v1-128k131,072 令牌¥60 CNY~$8.25¥60 CNY~$8.25完整文档, 合约
Kimi k1.5128,000 令牌请在 平台.moonshot.cn 验证n/a请在 平台.moonshot.cn 验证n/a复杂推理, 数学
Kimi VL128,000 令牌请在 平台.moonshot.cn 验证n/a请在 平台.moonshot.cn 验证n/a图像分析, OCR

美元价格仅为近似换算,供参考。Kimi API 的官方定价以人民币(CNY)为单位,可在平台 platform.moonshot.cn 查看。实际美元费用将取决于您的支付处理商的汇率。

⚠️ 价格截至 2025 年 6 月已核实。Kimi API 的定价经常变动。请务必在进行预算之前,于 平台.moonshot.cn/pricing 的 Moonshot AI API 定价页面确认当前费率。

最后更新:2025年6月


本页内容:


什么是 Moonshot Kimi API?

Moonshot AI(月之暗面)是一家总部位于北京的 AI 初创公司,成立于 2023 年。据报道,该公司到 2024 年已筹集了超过 10 亿美元的资金,致力于将自己定位为 OpenAI 和 Google 在大语言模型领域的中国竞争对手。该公司的开发者产品是位于 platform.moonshot.cn 的 Kimi API,这是一款与 kimi.ai 上的消费者聊天机器人相互独立的产品。本指南仅涵盖开发者 API。

Kimi API 采用与 OpenAI 兼容的 REST 格式,这意味着大多数 OpenAI SDK 示例只需极少的改动即可配合 Kimi 使用。这为已经在 GPT-4o 上运行的开发者提供了一条切实可行的迁移路径。

Token: LLM API 计费的文本基本单位。在英文中,1 个 Token ≈ 0.75 个单词,因此 1,000 个单词 ≈ 1,333 个 Token。您发送给模型的 Token(输入 Token)和模型响应中的 Token(输出 Token)都会被分别计量和计费。

上下文窗口是指模型在单次 API 调用中可处理的最大 Token 数量,包括输入和输出的总和。moonshot-v1-128k 模型支持 128K Token,大约相当于 96,000 个英文单词,或一部完整小说的篇幅,都可以在一次调用中处理。

Kimi 采用按量计费的计费模式,无需强制按月订阅。您只需为您消耗的代币付费,且不设固定的平台费用。

Bybit 上的 MOONSHOT 代币: Moonshot AI 在前沿人工智能领域的扩张吸引了加密货币交易者的关注 —— Bybit 为有兴趣交易 MOONSHOT 代币的人士提供 MOONSHOTUSDT 永续合约)。另请参阅 Bybit 上的 Moonshot AI IPO 交易机会.)

Kimi API 模型与定价 (2026)

Moonshot 通过 Kimi API 提供五种模型:三种根据上下文窗口大小区分的标准对话模型、一种推理模型,以及一种视觉语言模型。

模型类型上下文窗口价格范围(每百万 tokens, 人民币)最佳用途
moonshot-v1-8k聊天8,192 tokens¥12 人民币做空 任务,分类
moonshot-v1-32k聊天32,768 tokens¥24 人民币对话,中型文档
moonshot-v1-128k聊天131,072 tokens¥60 人民币整篇文档,法律,大型代码库
Kimi k1.5推理128,000 tokens请查阅文档复杂推理,数学,编码
Kimi VL视觉-语言128,000 tokens请查阅文档图像分析,OCR,视觉问答

💡 总成本 = (输入Token数量 × 每百万Token价格) + (输出Token数量 × 每百万Token价格)

输入 Tokens 是您发送给模型的消息中的 Tokens:您的系统提示、用户消息和任何对话历史。输出 Tokens 是模型生成的响应中的 Tokens。Kimi 在 moonshot-v1 系列中对输入和输出 Tokens 定价相同,这与 OpenAI 和 Anthropic 不同,它们的输出 Tokens 成本是输入 Tokens 的 3-5 倍。这种对称性使得 Kimi 的计费更容易估算,对于生成长响应的应用程序尤其如此。

对于聊天机器人,输入 Token 数会随着每一轮对话历史的增加而增长。对于文档摘要,相对于您发送的大量输入,输出成本较低。请据此规划您的 Token 预算。

流式响应不影响计费。无论是否启用流式传输,计费 Token 均相同。

ℹ️ 所有人民币价格均为官方Moonshot定价。表格中显示的美元价格为近似换算。官方定价以人民币(CNY)计价,在 platform.moonshot.cn。任何每百万Token(per-MTok)的价格除以1,000即可得到每1K Token的费率。

Kimi API 采用即用即付(pay-as-you-go)的定价模式,不设月度订阅计划。没有固定的分级费用,你按使用量付费。### moonshot-v1-8k

moonshot-v1-8k 是成本最低的 Kimi 模型,拥有 8,192 token 的上下文窗口,适用于不需要长上下文的简短问答、分类任务和单轮聊天机器人响应。

输入 (每 MTok)输出 (每 MTok)
CNY¥12 CNY¥12 CNY
USD*~$1.65~$1.65

“8k” 后缀表示的是 token 数量的上下文窗口大小,而不是版本或质量等级。当您的提示和响应能够舒适地容纳 8,192 个 token,并且您想要最低的每 token 费率时,请使用此模型。

最适合: 单轮问答、意图分类、短文本生成、具有简短交流的客户服务机器人。

moonshot-v1-32k

moonshot-v1-32k 提供 32,768 个 token 的上下文窗口,这足以支持多轮对话、中等长度的文档审查以及大多数代码审查任务,而无需支付 128K 模型全部的权利金。

Input (per MTok)Output (per MTok)
CNY¥24 CNY¥24 CNY
USD*~$3.30~$3.30

当您的使用场景超出 8K 上下文,但又无需在单次调用中处理完整的长篇文档时,请选择此模型。

最适用于: 多轮对话、代码审查、中等长度文档、带有上下文的邮件草拟。

moonshot-v1-128k

moonshot-v1-128k 支持 131,072 token 的上下文窗口,相当于约 96,000 字,或一本完整小说的长度。它是 Kimi 进行全文分析、法律合同审查和大型代码库处理的首选模型。每 MTok 价格为 60 元人民币(约 8.25 美元),在相同的 128K 上下文窗口大小下,此模型比 GPT-4o 便宜得多。

输入 (每 MTok)输出 (每 MTok)
人民币¥60 CNY¥60 CNY
美元*~$8.25~$8.25

这是大多数开发者在将Kimi与OpenAI的长上下文工作负载进行比较时会引用的模型。128K的容量单次调用即可覆盖约300页的技术文档。

最适合: 全文文档分析、法律合约审查、研究论文摘要、大型代码库处理、长篇书籍文本分析。

Kimi k1.5(推理模型)

Kimi k1.5 是一个独立的、专注于推理的模型,并非 moonshot-v1 系列的更大版本。它专为思维链任务而设计,包括复杂的数学问题、多步骤编码挑战以及研究分析。像 Kimi k1.5 这样的推理模型在扩展思维能力领域直接与 OpenAI o1/o3 和 DeepSeek-R1 竞争。

在预算制定前,应在 platform.moonshot.cn/docs 核实 Kimi k1.5 的定价。这是因为推理模型通常由于内部思维链处理所需的额外计算资源,其每代币费率比标准聊天模型更高。一些推理模型还会对“思考代币”单独收费。请在当前文档中确认 Kimi k1.5 是否适用此情况。

最适用于:复杂多步推理、高等数学、高难度编程挑战,以及需要逻辑链的研究综合。

欲了解 Kimi K3 的功能和基准的全面技术评测,请参阅 Kimi K3:Moonshot AI 的旗舰推理模型.

Kimi VL (视觉-语言模型)

Kimi VL 在单次 API 调用中同时支持图像和文本输入,其中文本代币(tokens)按每百万代币(MTok)计价,图像输入则根据分辨率单独计价。这是 Moonshot 推出的多模态视觉模型,适用于需要同时读取图像和文本的任务。

Kimi VL 的图像定价通常遵循按图块或按图像计费的方法,较高分辨率的图像会消耗更多 token。在构建基于视觉的应用程序之前,请在 platform.moonshot.cn/docs 验证当前的图像定价方法,因为图像 token 的费率与文本 token 的费率不同。

最适用于: 文档 OCR、图像分析、视觉问答、图表解读、截图转文字提取。

⚠️ 价格截至 2025 年 6 月已核实。所有价格可能会有所变动。请在制定预算前,在 platform.moonshot.cn 平台进行确认。

Kimi API 免费套餐:免费获得什么

免费版摘要: 新账户在注册后将获得约 ¥15 人民币的免费 API 额度。额度将在一定期限后过期(由于条款可能会变动,请在注册前到 platform.moonshot.cn 核实当前的过期日期)。适用免费版速率限制。所有 moonshot-v1 模型均可使用免费额度访问。

Moonshot 会在用户注册时向新账户分配免费试用额度。这只是一次性的额度分配,并非SaaS意义上的限时免费试用。你获得的是一个固定的信用额度余额,用于API调用,而不是30天的无限访问权限。

moonshot-v1-8k 每百万代币 (MTok) ¥12 人民币的价格计算,¥15 人民币的免费额度大约可涵盖 125 万个输入或输出代币。这足以在提交任何支付详情之前,进行数百次测试请求并初步完成基础集成的原型设计。

免费套餐的速率限制适用于测试和原型开发,但不适用于生产流量。如果您需要更高的吞吐量,则需要充值积分并升级到付费套餐。免费套餐适用于所有三个 moonshot-v1 模型,因此您可以使用您的免费积分测试 8K、32K 和 128K 的变体,以便在选择模型前比较输出质量。

领取您的免费奖励:

  1. 在 platform.moonshot.cn 注册
  2. 验证您的电子邮件或手机号码
  3. 验证完成后,免费奖励将自动发放到您的账户

在 platform.moonshot.cn 领取您的免费 Kimi API 额度。

各等级频率限制

速率限制控制您可以调用 Kimi API 的速度,以**RPM(每分钟请求数)TPM(每分钟令牌数)**为单位衡量。它们控制的是调用速度,而不是总月度用量。

账户等级RPM (每分钟请求数)TPM (每分钟 Token 数)备注
免费级3 RPM32,000 TPM仅限测试与原型开发
标准付费 (第 1 级)60 RPM200,000 TPM适用于低流量生产环境
标准付费 (第 2 级)300 RPM1,000,000 TPM中等规模生产工作负载
高额消费 / 企业级自定义自定义联系 Moonshot 获取专属限额

在构建生产应用程序之前,请在 platform.moonshot.cn/docs 处验证当前的速率限制值。速率限制的层级和阈值会随着 Moonshot 更新其平台而改变。

限额通常会随着您账户累计支出的增长而提高。Moonshot 将更高的限额与消费历史挂钩。在平台上的消费更多的账户,将逐步获得更高的 RPM 和 TPM 分配,而无需单独升级计划。

⚠️ 超出速率限制将返回 HTTP 429 Too Many Requests 错误。请在您的应用程序中实现指数退避重试逻辑,以优雅地处理速率限制响应。从 1 秒延迟开始,并在每次后续重试时加倍,直至达到最大等待时间。

如需申请超出您当前等级的额度提升,请通过平台控制面板 (platform.moonshot.cn) 或通过下方“企业与大宗定价”部分所述的企业咨询渠道联系 Moonshot 支持。

速率限制不同于支出限额。速率限制规定了您可以进行调用的速度,而不是您可以花费的总信用余额。预先充值特定的信用余额是控制总支出的主要机制。

如何计算您的 Kimi API 费用

💡 总成本 = (输入Token数量 × 每百万Token价格) + (输出Token数量 × 每百万Token价格)

输入 Token 是指您发送给模型的消息中的 Token。输出 Token 是指模型回复中的 Token。两者将分开计量,并按照上方价格表中的费率计费。在 moonshot-v1 系列中,输入和输出的定价相同,因此公式简化为:总 Token 数 × 每百万 Token (MTok) 价格。

单词与代币转换参考:

英文词汇近似标记数量
500 词~667 标记
1,000 词~1,333 标记
2,000 词~2,667 标记
5,000 词~6,667 标记

要计算您的月度成本,请遵循以下步骤:

  1. 估算您每次请求的平均输入 Token(系统提示 + 用户消息 + 历史记录)。
  2. 估算您每次请求的平均输出 Token(模型响应长度)。
  3. 将输入和输出 Token 相加,得到每次请求的总 Token 数。
  4. 乘以您每天的请求次数,以计算每日 Token 消耗量。
  5. 应用所选模型的每百万 Token (MTok) 费率:总 Token 数 ÷ 1,000,000 × 每 MTok 价格。
  6. 乘以 30 以获得每月估算费用。

请参考此表格,根据字数估算您的输入大小。如需在调用前进行更精确的 Token 计数,请使用 OpenAI tiktoken (github.com/openai/tiktoken) 作为参考。Kimi 的分词器可能略有不同,请查阅 platform.moonshot.cn/docs 以获取 Moonshot 的官方分词器端点。

实际案例 A:聊天机器人(中等流量)

场景: 一个客服聊天机器人每天处理 1,000 次查询,每次查询包含 800 个输入 token 和 400 个输出 token。模型:moonshot-v1-8k

  • 每日输入 Token:1,000 × 800 = 800,000 Token = 0.8 MTok
  • 每日输出 Token:1,000 × 400 = 400,000 Token = 0.4 MTok
  • 每日总计:1.2 MTok × ¥12 CNY = ¥14.40 CNY/日(约 $1.98 USD/日)
  • 每月成本:约 ¥432 CNY(约 $59 USD)

示例 B:文档摘要生成器(低用量)

场景: 研究工具每天处理 100 份文档,每份文档包含 10,000 个输入 token 和 500 个输出 token。模型:moonshot-v1-128k (适用于处理长文档)。

  • 每日输入令牌:100 × 10,000 = 1,000,000 令牌 = 1 MTok
  • 每日输出令牌:100 × 500 = 50,000 令牌 = 0.05 MTok
  • 每日总计:1.05 MTok × ¥60 人民币/日 = ¥63 人民币/日 (~8.67 美元/日)
  • 每月费用:~¥1,890 人民币 (~260 美元)

案例 C:代码助手(中等用量)

场景: 开发者工具每天发送 500 次请求,每次包含 2,000 个输入 token 和 800 个输出 token。模型:moonshot-v1-32k

  • 每日输入代币:500 × 2,000 = 1,000,000 代币 = 1 MTok
  • 每日输出代币:500 × 800 = 400,000 代币 = 0.4 MTok
  • 每日总计:1.4 MTok × ¥24 CNY = ¥33.60 CNY/天 (~$4.62 USD/天)
  • 每月成本:~¥1,008 CNY (~$139 USD)

Kimi 的计费采用信用额度预付模式。您需为账户余额充值,API 调用将从中扣除费用。如需持续追踪成本,请使用 Artificial Analysis (artificialanalysis.ai) 参考最新的美元定价,将 Kimi 与其他供应商进行基准对比。

Kimi API 与竞争对手:价格对比

下表对比了截至 2025 年 6 月,Kimi API 与 OpenAI、DeepSeek、Anthropic 和 Google Gemini 的价格,所有数值均以每百万 Token 的美元(USD)为单位。

提供商模型输入 (每百万 Token, 美元)输出 (每百万 Token, 美元)上下文窗口备注
Moonshot Kimimoonshot-v1-8k~$1.65~$1.658K最低价 Kimi
Moonshot Kimimoonshot-v1-32k~$3.30~$3.3032K中端
Moonshot Kimimoonshot-v1-128k~$8.25~$8.25128K旗舰长上下文
OpenAIGPT-4o$2.50$10.00128K请在 platform.openai.com 的 OpenAI 定价页面进行验证
OpenAIGPT-4o mini$0.15$0.60128K请在 platform.openai.com 的 OpenAI 定价页面进行验证
DeepSeekDeepSeek-V3$0.27$1.1064K请在 platform.deepseek.com 的 DeepSeek 定价页面进行验证
AnthropicClaude 3.5 Sonnet$3.00$15.00200K请在 anthropic.com/pricing 的 Anthropic 定价页面进行验证
GoogleGemini 1.5 Pro$1.25$5.00100万 Token请在 ai.google.dev/pricing 的 Google AI 定价页面进行验证

⚠️ 所有价格已于 2025 年 6 月核实。LLM 提供商的定价变动频繁。在做出供应商决策前,请务必前往官方文档页面核实所有价格。

Kimi 的 moonshot-v1-128k 模型在输入和输出方面的费用均为每 MTok 约 8.25 美元,而 GPT-4o 在相同 128K 上下文窗口下的费用为每 MTok 输入 2.50 美元 / 输出 10.00 美元。对于生成大量输出的应用,Kimi 显然更具价格优势。

当 Kimi 胜出时: 适用于 128K 的长文本工作负载(此时 GPT-4o 的输出成本变得非常显著),或者输入和输出量对称的应用场景(此时 Kimi 相同的输入/输出定价可简化预算编制)。

当竞争对手可能胜出时: DeepSeek-V3 在每 token 费率上大幅低于 Kimi(输入 0.27 美元,而 Kimi 8K 约为 1.65 美元),用于做空(short-context)任务。Google Gemini 1.5 Pro 提供 1M token 的上下文窗口,每 MTok 费用为 1.25 美元/5.00 美元,更适合处理超过 128K token 的工作负载。Anthropic Claude 3.5 Sonnet 提供 200K 的上下文窗口,并具有强大的推理能力,适合那些需要超出 Kimi 128K 上下文容量的团队。

在中国国内大语言模型生态系统中进行比较的中国开发者,可能也会评估阿里云的通义千问(Qwen),它在处理中文任务方面具有极具竞争力的价格优势。

为了更广泛的模型间比较,包括基准测试和用例契合度,请参阅 Moonshot AI vs DeepSeek vs Qwen:中国AI模型比较.)


如何降低您的 Kimi API 成本

Kimi API 中最大的成本杠杆是模型选择:对于适合 8K 上下文窗口的任务,使用 moonshot-v1-8k 而不是 moonshot-v1-128k,可以将每 token 的支出降低 5 倍。在扩展任何 Kimi 驱动的应用之前,请审阅以下策略。

  1. 选择正确的模型层级。 审计您实际的提示和响应长度。如果您的平均请求使用少于 6,000 个 token,moonshot-v1-8k 的价格为 ¥12 CNY/MTok,而不是 ¥60 CNY/MTok。价格差异会随着规模的扩大而累积。

  2. 截断对话历史。 在多轮聊天机器人应用中,每一轮都重新发送完整的对话历史会累积大量的输入 Token 计数。在上下文窗口中仅保留最近的 3 至 5 次对话,而不是整个会话记录。

  3. **精简您的提示。**从系统提示中移除冗余的指令、重复的上下文和冗长的措辞。一个可从 500 个 token 缩减至 200 个 token 的系统提示,每次请求可节省 300 个 token。每月 100,000 次请求,相当于 3000 万 token 的储蓄。

  4. 缓存重复响应。 如果您的应用程序经常发送相同或几乎相同的查询(例如,FAQ机器人、使用相同基本提示的产品描述生成器),请缓存响应,并完全跳过重复输入的 API 调用。

  5. 设定支出上限。 在 Kimi 账户余额中预先加载特定的信用额度,而不是启用自动充值。这可以作为硬性支出上限。当余额为零时,API 调用将停止。通过平台.moonshot.cn 仪表板定期检查您的余额。

  6. 使用 max_tokens 参数。 在您的 API 请求中设置 max_tokens 以限制输出长度,适用于那些不需要长响应的任务。分类任务、是/否回答以及提取任务通常不需要超过 100-200 个输出 token。

  7. 在费用账单仪表板中监控使用情况。 在 platform.moonshot.cn 平台仪表板中,按模型和日期查看 Token 消耗量。识别哪些端点消耗的 Token 最多,通常会发现仅凭代码检查难以察觉的优化机会。

企业及批量定价

Moonshot AI 没有公开列出企业或大批量折扣定价。本文中的费率仅反映公开提供的按量计费定价。如需企业合约、专属速率限制或大批量折扣,请通过 platform.moonshot.cn 上的企业咨询表单直接联系 Moonshot AI。

大规模评估 Kimi 的组织通常需要评估:高于标准付费套餐的专用速率限制上限、与每月代币支出挂钩的批量折扣门槛、数据驻留保证和合规性认证、SLA 条款和正常运行时间承诺,以及合同数据处理协议。

截至撰写本文时,这些条款均未公开披露。请勿假设在任何特定的支出门槛下都存在成交量折扣。在根据折扣假设进行财务预测之前,请直接向 Moonshot 的销售团队核实。

Kimi API 在中国以外是否可用?

是的,海外开发者可以通过 platform.moonshot.cn 访问 Kimi API。国际开发者可以按照标准注册流程创建账户并生成 API 密钥,该流程支持使用国际电子邮件地址。

非中国用户注册时应验证付款方式的接受情况。可接受的方式可能包括国际信用卡或第三方支付处理器。在尝试添加账单信息之前,请在 platform.moonshot.cn 上确认支持的支付选项。

国际用户的注册流程与中国用户的流程相同:创建账户,验证您的手机号码或电子邮件,并在仪表板上生成 API 密钥。部分国际手机号码可能无法用于短信验证。如果您遇到这种情况,请使用电子邮件验证或联系 Moonshot 支持。

🔒 数据隐私声明: Moonshot AI 是一家中国公司,其 Kimi API 基础设施在中国法律和数据法规下运行。API 请求数据将在中国境内的 Moonshot AI 服务器上进行处理。处于受监管行业或有数据驻留要求的司法管辖区的开发者,在生产环境中部署 Kimi API 之前,应查阅 platform.moonshot.cn 上的 Moonshot 隐私政策。请勿在未查阅 Moonshot 合规性文档和数据处理协议的情况下,发送受 GDPR、HIPAA 或其他受监管数据框架约束的数据。

对于有合规要求的企业用户而言,缺乏公开记录的数据驻留期权、SOC 2 认证或数据处理协议是一个实质性的考量因素。请将任何合规咨询转交给 Moonshot 的企业团队。但这并不构成在所有用例中都排除使用 Kimi 的理由。许多开发者应用程序处理的是非敏感数据,在这些情况下,中国司法管辖权并不构成合规障碍。关键在于进行审慎的评估,而非凭空假设。

如何开始使用 Kimi API

只需不到五分钟,按照以下步骤即可创建 Kimi API 账户并生成您的第一个 API 密钥。

在平台.moonshot.cn 创建账户。 国际用户可能需要提供手机号码进行短信验证。请准备好一个国际手机号码,或在您所在国家/地区无法进行电话验证时,选择电子邮件注册。

  1. 验证您的电子邮件或手机号码。 完成验证步骤,以激活您的账户并解锁免费试用积分。

  2. 领取您的免费试用额度。 新账户在通过验证后将自动获得约 ¥15 CNY 的免费额度。请在控制面板查看您的账户余额,以确认额度已到账。

  3. 导航至仪表盘中的“API 密钥”。 登录后,便可从主仪表盘菜单访问 API 密钥管理部分。

  4. 生成新的 API 密钥并将其复制。 点击“创建 API 密钥”,为其取一个描述性名称,并立即复制该密钥。创建页面关闭后,系统将不再显示完整的密钥。

  5. 将API密钥存储为环境变量。MOONSHOT_API_KEY=your_key_here 添加到你的 .env 文件或部署环境的密钥管理器中。切勿将密钥直接硬编码到源文件中,或将其提交到版本控制。

  6. 查阅 API 文档。Kimi API 使用 OpenAI 兼容的格式。基本 URL 会有所不同,但请求结构与 OpenAI Chat Completions API 完全相同。大多数 OpenAI SDK 示例只需稍作修改即可使用。在 平台.moonshot.cn/docs 访问完整文档。

在 platform.moonshot.cn 获取您的免费 Kimi API 密钥。


常见问题

Kimi API 的费用是多少?

Kimi API 的费用介于 moonshot-v1-8k 模型的每百万 token 12 元人民币(约 1.65 美元)到旗舰级 moonshot-v1-128k 模型的每百万 token 60 元人民币(约 8.25 美元)之间。moonshot-v1 系列的输入和输出 token 定价相同,这与 OpenAI 的定价结构不同,后者输出 token 的费用是输入的 4 倍。所有定价均采用按量计费模式,无需支付强制性的订阅费。

Kimi API 是否提供免费层级?

是的。新账户在 platform.moonshot.cn 平台注册时将获得约 ¥15 CNY 的免费试用额度。这些额度适用于所有 moonshot-v1 模型,允许您在添加支付凭据前进行集成原型测试。免费额度为一次性分配,而非持续的免费层级。一旦消耗完毕,您需要添加付费额度以继续使用。免费层级的速率限制(约 3 RPM)适用于测试,但不适用于生产流量。请参阅上方的 Kimi API 免费层级 部分以获取详细信息。

Kimi API 的最大上下文窗口是多少?

目前公开可用的最大 Kimi API 模型 moonshot-v1-128k 支持 128K token 的上下文窗口,约等于 96,000 个单词或一整本长篇小说。Kimi 还以更低的价格提供 moonshot-v1-8k(8,192 token)和 moonshot-v1-32k(32,768 token)。Moonshot 在研究中展示了 100 万 token 的实验性上下文,但目前尚未通过公开 API 提供。

Kimi API 的价格与 OpenAI GPT-4o 相比如何?

在相当的上下文窗口大小下,特别是针对输出密集型工作负载,Kimi 比 GPT-4o 更便宜。在 128K 上下文时,GPT-4o 的输入成本为每百万代币 $2.50,输出为每百万代币 $10.00,而 Kimi moonshot-v1-128k 的输入和输出费用均为每百万代币约 $8.25。对于生成大量输出的应用,实际的成本差异非常显著。对于输入密集但输出较短的工作负载,GPT-4o mini 的费用为每百万代币 $0.15/$0.60,比任何 Kimi 模型都便宜。请参阅上方的完整价格对比表

Kimi API 是否在中国境外可用?

是的。Kimi API 可通过 platform.moonshot.cn 平台在全球范围内访问。国际开发者可以通过标准注册流程进行注册、添加支付凭据,并在中国境外使用该 API。数据在 Moonshot AI 位于中国的基础设施上进行处理。受监管行业且有数据驻留要求的开发者在部署到生产环境前,应审阅 Moonshot 的隐私政策。请参阅上方的国际可用性部分以获取完整的隐私声明。

Moonshot Kimi 通过 API 提供哪些模型?

Moonshot 通过 Kimi API 提供五种模型:moonshot-v1-8k(8K 上下文,成本最低)、moonshot-v1-32k(32K 上下文,中等级别)、moonshot-v1-128k(128K 上下文,旗舰)、Kimi k1.5(具备链式思考能力的推理模型,可与 OpenAI o1 媲美)以及 Kimi VL(接受图像和文本输入的视觉语言模型)。每种模型都有单独的定价,moonshot-v1 系列已公开列出,Kimi k1.5/VL 的定价需在 platform.moonshot.cn/docs 进行验证。

如何计算我的 Kimi API 费用?

使用公式:总成本 = (输入 Token 数量 × 每百万个 Token 的输入价格) + (输出 Token 数量 × 每百万个 Token 的输出价格)。例如,在 moonshot-v1-8k 上,一个聊天机器人每次请求发送 800 个输入 Token 并接收 400 个输出 Token,其成本为 (800 × ¥12/1,000,000) + (400 × ¥12/1,000,000) = 每次请求 ¥0.0144 人民币(约合 $0.002 美元)。按每天 1,000 次请求计算,每月总计约为 ¥432 人民币(约合 $59 美元)。有关不同使用规模的完整计算示例,请参阅上方的 如何计算您的 Kimi API 成本 章节。

Kimi API 的频率限制是多少?

速率限制因账户级别而异。免费套餐限制为每分钟约 3 次请求 (RPM) 和每分钟 32,000 个令牌 (TPM),这足以用于测试,但不适用于生产流量。标准的付费套餐提供每分钟 60-300 次请求 (RPM) 和每分钟 200,000-1,000,000 个令牌 (TPM),并根据累计账户支出进行扩展。超出速率限制将返回 HTTP 429 Too Many Requests 错误。有关完整的套餐比较表,请参阅上面的 各级别速率限制 部分。

Kimi API 比 GPT-4 便宜吗?

是的,moonshot-v1-128k 的每 MTok 输入和输出大约为 8.25 美元,远低于 GPT-4o 在等效 128K 上下文窗口下的输出价格 10.00 美元/MTok。对于对称的输入/输出工作负载,节省的成本是可观的。然而,DeepSeek-V3 在短上下文任务上的价格更低(每 MTok 0.27 美元/1.10 美元),而 Google Gemini 1.5 Pro 则为超出 128K 上下文的应用提供了 100 万个 token 的上下文窗口,价格为 1.25 美元/5.00 美元/MTok。Kimi 的价格优势在长上下文、输出密集型工作负载中最为明显,在这些工作负载中,GPT-4o 的输出成本占了账单的大部分。

如何获取 Kimi API 密钥?

在 platform.moonshot.cn 注册账户,验证您的电子邮件或电话号码,前往仪表盘的“API 密钥”部分,并生成新密钥。立即从创建屏幕复制它。将密钥作为环境变量(MOONSHOT_API_KEY)存储在您的项目中。切勿将其硬编码在源代码文件中。新账户在验证后还会自动获得免费试用额度。


Kimi API 的定价将 moonshot-v1-128k 定位为做多上下文工作负载中具有成本竞争力的选择,尤其是在 GPT-4o 或 Claude 大规模使用变得昂贵的情况下,特别适用于受益于 Kimi 相同的输入/输出定价结构的输出密集型应用。

在 platform.moonshot.cn 查看当前的 Kimi API 价格。

最后更新:2025年6月 | 价格来源及验证于平台.moonshot.cn/docs

相关阅读