Kimi API 价格怎么算?Moonshot 各模型多少钱与省钱用法
数据截至 2026-08-09,价格与限额以各官网为准。本次更新逐一重核了官方定价页。
Kimi(Moonshot)API 按 token 计费,输入 token 又分”缓存命中”和”未命中”两种单价,两者能差 5-6 倍;真正决定账单的不是表面单价,而是你的请求有没有命中自动缓存、选的模型档位对不对。搞懂这两点,同样的活儿成本能差出好几倍。
先说一件容易踩坑的事:Kimi 的官方入口最近改了名字。很多人还在按老印象找 moonshot.cn,其实现在已经是另一套域名了,模型清单也换了一批。这篇先把入口和现状理清楚,再讲计费和省钱。
官方域名已经迁移,别按老地址找
如果你之前用过 Kimi API,可能对 platform.moonshot.cn 这个域名有印象。现在打开会发现它已经 301 永久跳转到了 platform.kimi.com——这是大陆/人民币计价站。国际版同理,platform.moonshot.ai 跳转到了 platform.kimi.ai,走美元计价。
这两个站不是同一套账户互通的两个入口,而是同一产品对应的两套独立账户体系:一套走人民币结算,base_url 对应 api.moonshot.cn;一套走美元结算,base_url 对应 api.moonshot.ai。哪套 key 能不能跨站用,官方没有明确说明,稳妥的做法是按你实际注册的那个站点走到底,别中途混用。如果你是老用户,建议直接去新域名重新确认一下账户信息,免得对着一个已经跳转的旧地址反复排查”为什么打不开”。
顺带说一句模型迭代的事:如果你看到教程里提到 kimi-k2、kimi-k2-0711-preview、kimi-k2-thinking 这类名字,那是旧版本,官方已经在 2026-05-25 把这几个下线了。
阵容这一版又变了:现在的旗舰是 kimi-k3,支持 1M 上下文,K2.6 从”当前旗舰”退成了多模态款,K2.7 系列(含代码专用版)和 K2.5 继续在售。另外经典的 moonshot-v1 系列官方标注”预计 8 月 31 日全平台下线”——如果你手上还有项目跑在这条产品线上,这次是真的该动手迁移了,别等到接口报错才开始查。
各模型单价表
Kimi 的计费单位和大多数大模型 API 一样,按每百万 token(不管中文还是英文,统一按 token 数算)计价,输入和输出分开算钱。但 Kimi 有个跟不少家不太一样的地方:输入价格本身又拆成了”缓存命中”和”缓存未命中”两档,而且这套缓存是自动生效的,不需要你在代码里手动开启或指定断点。
先看大陆站(platform.kimi.com,人民币计价,单位是元/百万 token):
| 模型 | 上下文长度 | 输入·缓存命中 | 输入·未命中 | 输出价 |
|---|---|---|---|---|
kimi-k3(当前旗舰,1M 上下文) | 1,048,576 | ¥2.00 | ¥20.00 | ¥100.00 |
kimi-k2.7-code(编程专用模型) | 262,144 | ¥1.30 | ¥6.50 | ¥27.00 |
kimi-k2.7-code-highspeed(高速版,约 180-260 tokens/s) | 262,144 | ¥2.60 | ¥13.00 | ¥54.00 |
kimi-k2.6(多模态,文本+图片+视频) | 262,144 | ¥1.10 | ¥6.50 | ¥27.00 |
kimi-k2.5(上一代,仍在售,性价比更高) | 262,144 | ¥0.70 | ¥4.00 | ¥21.00 |
国际站(platform.kimi.ai,美元计价)本次只复核了旗舰款:kimi-k3 是 1,048,576 上下文,输入命中 $0.30、未命中 $3.00、输出 $15.00,官方另注明价格不含税。其余型号的美元价这次没有逐一复核,之前记录的数字(k2.7-code 约 $0.19/$0.95/$4.00、k2.6 约 $0.16/$0.95/$4.00、k2.5 约 $0.10/$0.60/$3.00)仅供感受量级,正式报价请自己打开国际站页面确认当次数字。
读表的几个要点。
**第一,K3 是旗舰,但它的旗舰溢价非常陡。**输出 ¥100.00 是 K2.6 的近 4 倍,未命中输入 ¥20.00 是 K2.6 的 3 倍多。换来的是上下文从 262,144 跳到 1,048,576,也就是四倍长度。所以选 K3 的理由应该是”我确实需要塞进去这么长的东西”,而不是”它是最新的”——如果你的请求根本用不满 262K,付这份旗舰溢价基本是浪费。
**第二,输出价明显比输入贵。**无论哪个模型,输出价都在未命中输入价的 4-5 倍,跟 Claude、GPT 那套规律一致,长文本生成、代码生成这类输出量大的任务,成本大头在输出侧。
第三,缓存命中和未命中的差距很大,大陆站基本是 5-6 倍(K2.6 是 ¥1.10 对 ¥6.50,K3 是 ¥2.00 对 ¥20.00,后者差到 10 倍)。同一个请求命中与否,输入这一项能差出好几倍,比很多人想象的影响大。K3 这个 10 倍差距尤其值得注意——旗舰模型贵,但把缓存吃好了,贵的那部分能压回去不少。
第四,kimi-k2.7-code-highspeed 是拿钱换速度,单价正好是普通版的 2 倍,只有对首字延迟特别敏感的场景才值得多付。
另外那类经典的 moonshot-v1-8k/32k/128k 系列(含视觉版),上面已经说过——官方标注预计 8 月 31 日全平台下线,所以这一版不再列它的价格了,该做的不是查价而是排迁移计划。
OpenAI 兼容调用,换个 base_url 就行
Kimi API 的一个实际优点是完全兼容 OpenAI 的 Python SDK,如果你之前写过 OpenAI 或者其他兼容 OpenAI 接口的调用代码,迁移过来几乎不用改逻辑,只需要换 base_url 和 api_key。
大陆站的最小示例(来自官方 quickstart 文档):
from openai import OpenAI
client = OpenAI(
api_key="$MOONSHOT_API_KEY",
base_url="https://api.moonshot.cn/v1",
)
completion = client.chat.completions.create(
model="kimi-k2.6",
messages=[{"role": "user", "content": "你好"}]
)
print(completion.choices[0].message.content)
国际站只需要把 base_url 换成 https://api.moonshot.ai/v1,其余代码一字不改。密钥申请也很直接:登录 platform.kimi.com,控制台左栏找到「API Key 管理」,点新建,立即复制保存——这个 key 只显示一次,关掉弹窗前一定要存好。
如果你想在代码里动态确认某个模型支持什么能力(比如是否支持传图片、是否支持推理模式),可以调用官方的 GET https://api.moonshot.cn/v1/models,返回里会带 context_length、supports_image_in、supports_video_in、supports_reasoning 这些字段,比翻文档更省事。
月成本怎么估算
估算方法和其他家 token 计费的 API 大同小异,公式是:
单次成本 = 输入 token 数 / 1,000,000 × 对应输入单价(命中或未命中)
+ 输出 token 数 / 1,000,000 × 输出单价
月成本 ≈ 单次成本 × 每月请求数
举个例子,用 kimi-k2.6(大陆站,人民币计价)做一个客服问答功能,假设每次请求输入 2,000 token、输出 500 token,每天 2,000 次请求,先算一个”完全没命中缓存”的悲观场景:
- 单次输入成本:2,000 / 1,000,000 × ¥6.50 = ¥0.013
- 单次输出成本:500 / 1,000,000 × ¥27.00 = ¥0.0135
- 单次合计:约 ¥0.0265
- 每天 2,000 次:约 ¥53
- 一个月(30 天):约 ¥1,590
同样的负载,如果系统提示和参考资料是固定的、大部分请求都命中了缓存(假设命中率 80%):
- 命中部分输入成本:2,000 × 0.8 / 1,000,000 × ¥1.10 ≈ ¥0.00176
- 未命中部分输入成本:2,000 × 0.2 / 1,000,000 × ¥6.50 ≈ ¥0.0026
- 加上输出成本 ¥0.0135,单次合计约 ¥0.0179
- 一个月:约 ¥1,074
同一套负载,命中率从 0 提到 80%,账单能省下三成多——这还只是一个 2,000 输入 token 的中等场景,请求里固定内容占比越高、命中率越高,省下来的比例就越大。估算时的可靠做法是先跑一批真实样本,记录 usage 字段里到底命中了多少、没命中多少,再按实测比例套公式,别拍脑袋按 100% 命中算——那样容易把成本估得虚低,实际上线后被账单反打脸。
想理解”该盯哪些成本指标”而不是只盯着调用量刷数字,可以参考 把 Token 当 KPI:AI 转型最贵的坑,讲的是更宏观的误区,跟这里的单价计算是两个层面但互相有关。
省钱调用法
单价改不了,但下面几件事能实打实压低账单。
一、把固定内容做成能命中缓存的前缀
Kimi 的自动上下文缓存不需要额外开启,但要真正吃到那 5-6 倍的差价,你的请求结构需要配合它——把不变的部分(系统提示、参考文档、few-shot 示例)放在请求最前面,把每次都变化的用户输入放在后面。缓存本质上是按前缀匹配的,前面任何一处发生变化,后面就没法复用了。如果你的代码里把系统提示和用户消息顺序打乱、或者每次都往系统提示里塞一点动态内容(比如当前时间戳),缓存会一直命不中,白白多付好几倍的输入钱却不自知。
排查方式很直接:看响应里 usage 字段的命中和未命中 token 数是不是符合预期,而不是假设它”应该”在命中。
二、别默认用高速版
kimi-k2.7-code-highspeed 单价接近普通版的 2 倍,只有对首字延迟或生成速度特别敏感的场景(比如需要实时打字机效果的交互产品)才值得多花这份钱。批量任务、离线处理这类不在乎快几秒的场景,用普通版就够,把钱省下来。
三、按任务难度选模型档位,别一个模型打天下
K3 是 1M 上下文的旗舰,K2.7 Code 定位编程任务,K2.6 是通用多模态款,K2.5 是上一代但仍在售、价格更低。如果你的任务只是简单的文本分类、摘要、意图识别,没必要上最新最贵的 K3——它的输出价是 K2.5 的近 5 倍,而这类任务根本吃不到 1M 上下文的好处。实操建议是先拿一批真实样本人工对比几个档位的输出质量,再决定生产环境默认走哪个,而不是想当然选”最新的肯定最好”。
判断该不该上 K3,有个很实际的标准:看你的请求实际用掉多少上下文。如果 P95 的输入长度连 262K 的一半都到不了,那 K3 多出来的那 4 倍窗口对你就是纯浪费,留在 K2.6 或 K2.5 更划算;只有当你确实在做整本书、整个代码库、超长会话历史这类活儿,K3 的溢价才买到了实际价值。
四、留意联网搜索工具的额外收费
如果你的应用调用了 Kimi 的联网搜索工具(web_search),大陆站文档明确写了会额外收费 ¥0.03/次——但前提是这次调用最终确实触发了搜索(finish_reason 是 tool_calls 且真的调用了);如果模型最后是以 stop 结束、没有实际发起搜索,就不收这笔钱。如果你的应用大量挂载了联网搜索工具但很多请求其实用不上,这笔小钱积少成多也会在月账单里体现出来,值得留意工具调用的触发频率。
五、批量任务走 Batch,官方是六折
上一版这里写的是”有折扣但没核实到比例”,这次查到了:Kimi 的批量推理费用是标准模型价格的 60%,也就是打六折。折算下来的实价是这样的:
| 模型(Batch) | 输入·命中 | 输入·未命中 | 输出 |
|---|---|---|---|
kimi-k2.7-code | ¥0.78 | ¥3.90 | ¥16.20 |
kimi-k2.6 | ¥0.66 | ¥3.90 | ¥16.20 |
kimi-k2.5 | ¥0.42 | ¥2.40 | ¥12.60 |
有一个关键限制要注意:Batch 目前只支持 K2.7-code、K2.6、K2.5 这三款,旗舰 kimi-k3 不在支持列表里。所以如果你的批量任务本来打算用 K3 跑,就得在”用 K3 但付全价”和”降档到 K2.6 吃六折”之间做个取舍——K2.6 的 Batch 未命中输入才 ¥3.90,比 K3 的全价 ¥20.00 便宜五倍多,对不那么吃上下文长度的批量活儿,这个差价很难忽略。
六折不如某些平台的五折狠,但它和缓存折扣是可以叠在一起看的:命中缓存的 Batch 请求,输入价能低到 ¥0.42(K2.5)。离线批处理场景值得优先接这条路。
常见坑 / 注意
- 域名已经改了:
moonshot.cn/moonshot.ai会跳转到kimi.com/kimi.ai,别再按老印象死记旧域名,账户体系两边不通用。 - 旧模型已下线:
kimi-k2、kimi-k2-thinking等系列 2026-05-25 已停止维护,新文章、新代码都别再往这些名字上写。 moonshot-v1系列预计 8 月 31 日下线:老项目还跑在这条线上的,现在就该排迁移,别等接口报错。- K3 的旗舰溢价很陡:输出 ¥100 是 K2.6 的近 4 倍,换来的是 4 倍上下文。用不满 262K 就别为 1M 付钱。
- Batch 不支持 K3:六折只覆盖 K2.7-code / K2.6 / K2.5,批量任务用 K3 得付全价,降档往往更划算。
- 缓存命中差价很大:大陆站约 5-6 倍,K3 更是差到 10 倍,请求结构没设计好(固定内容不在前缀)会白白多付钱。
- 高速版是加价买延迟:
highspeed单价正好是普通版 2 倍,日常批量任务别默认选它。 - 联网搜索工具单独计费:¥0.03/次,只在真正触发搜索时收取,注意工具触发频率。
- 国际站美元价只复核了 K3:其余型号的美元数字未逐一复核,正式报价前自己打开 platform.kimi.ai 确认。
- 两套账户体系区分币种:CNY 站和 USD 站是两套账户,别假设 key 能跨站通用。
接下来看什么
留言讨论
评论发布后会被人工复核,违规内容将被删除。
如果发表没有反应,可以前往联系我们告诉我们。