国产大模型 API 价格对比:DeepSeek/Kimi/GLM/通义/豆包怎么选
数据截至 2026-08-09,价格与限额以各官网为准。本次更新逐一重打开了五家官网定价页(含用浏览器渲染此前抓不到的动态页面)。
先说结论:预算极度敏感、能接受批量/异步的活儿,DeepSeek 的缓存命中价和 GLM 的免费档几乎是白菜价;要处理超长文档,Kimi K3 和 GLM-5.2 都给到了 1M 上下文,但旗舰溢价很陡,先确认你真用得上;写代码,Kimi 的 K2.7-code 和豆包的 seed-code 都做了专门定价,后者的缓存命中价不跳档、长上下文特别划算;生态在阿里云、任务类型杂,通义千问的矩阵最全,但要留意限时折扣会到期。没有哪一家在所有维度都赢,先看自己最常跑的那类任务,再对着下面的表挑。
这一版更新了什么
这篇上一版写于 2026 年 7 月初,一个月后重核,发现过时的不只是型号名,还有几处结构性的变化:
- GLM 已经不是固定单价了,旗舰全系改成按输入长度(部分还看输出长度)分段计价,上一版”固定单价”的定性是错的;
- GLM 的完整价目表这次拿到了。上一版因为官网定价页是 JS 渲染、抓取拿到空壳,只能标”未核实、请自行核对”,这次用浏览器渲染后读到了官方原文数字,那些留白全部补上;
- Kimi 的旗舰换成了 K3(1M 上下文),K2.6 退居多模态款;经典的
moonshot-v1系列官方预告 8 月 31 日全平台下线; - 通义的主力换成了 qwen3.8-max / qwen3.7-plus,且部分型号正挂着限时 5 折、8 折;
- DeepSeek 官方文档里出现了涨价预告:“计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大”;
- 豆包的官方价格总表这次也拿到了,上一版靠第三方转述交叉印证的数字得以核准。
先声明一句:这篇比的是什么
这篇比的是五家 API 的调用成本——每百万 token 输入/输出多少钱、缓存折扣力度、免费额度规则,全部是能直接拿去算账单的硬数字。它不是对话产品体验横评,不涉及”哪家聊天更好用""谁的回答更聪明”这类主观感受。如果你想看的是 DeepSeek、Kimi、豆包三款对话工具日常用起来谁更顺手,去看 DeepSeek vs Kimi vs 豆包:国产对话工具怎么选,那篇讲的是产品体验,这篇讲的是接口账单。两篇角度不同,别搞混。
价格总表:每家旗舰与性价比档各一行
统一口径说明:以下全部是人民币,且全部来自各家中国大陆站官方页面——DeepSeek、GLM、通义千问、豆包本身就是人民币定价,Kimi 则取大陆站 platform.kimi.com 的价格(它还有一个美元计价的国际站 platform.kimi.ai,两套账户体系不互通,本文不混用)。
分段/阶梯计价的模型,表里给的是最低档的价格,后面标了跳档情况。
| 厂商 | 档位 | 代表模型 | 输入(元/百万) | 缓存命中 | 输出(元/百万) | 上下文 / 计费档 |
|---|---|---|---|---|---|---|
| DeepSeek | 旗舰 | deepseek-v4-pro | 3 | 0.025 | 6 | 1M |
| DeepSeek | 性价比 | deepseek-v4-flash | 1 | 0.02 | 2 | 1M |
| Kimi | 旗舰 | kimi-k3 | 20 | 2.00 | 100 | 1,048,576 |
| Kimi | 性价比 | kimi-k2.5 | 4.00 | 0.70 | 21.00 | 262,144 |
| 智谱 GLM | 旗舰 | GLM-5.2 | 8 | 2 | 28 | 1M |
| 智谱 GLM | 性价比 | GLM-4.7-Flash | 免费 | 免费 | 免费 | 200K |
| 通义千问 | 旗舰 | qwen3.8-max | 12 | 按输入价 10% | 36 | 计费档至 1M |
| 通义千问 | 性价比 | qwen3.7-flash | 0.2(最低档) | 按输入价 10% | 0.8(最低档) | 计费档至 1M |
| 豆包 | 旗舰 | doubao-seed-2.1-pro | 6.00 | 1.20 | 30.00 | 计费档 [0,256] |
| 豆包 | 性价比 | doubao-seed-1.6-flash | 0.15(最低档) | 0.03 | 1.50(最低档) | 计费档 [0,256] |
几个必须提前说清楚的口径细节,不然这张表容易看错:
- “上下文 / 计费档”这一列要分两种读法。DeepSeek、Kimi、GLM 那几行是官方标注的上下文窗口;通义和豆包那几行是计费阶梯的区间上限,它反映的是”价格分档分到多长”,不能直接等同于官方标称的最大上下文。要用准确的窗口数字,去对应的模型详情页看。
- **三家的最低档不是它的常态价。**通义
qwen3.7-flash的 0.2 元只在输入不到 32K 时有效,超过就变 0.6 元、再超变 1.2 元;豆包doubao-seed-1.6-flash同理(0.15→0.30→0.60)。跳档时整次请求(含输出)都按新档结算,不是超出部分单独加价,这点对长上下文场景杀伤力很大。 - **GLM 现在也是分段计价了。**表里的 GLM-5.2 是全量单价没错,但 GLM-5.1、GLM-5、GLM-4.7 都按输入长度分两到三档,GLM-4.7 和 GLM-4.5-Air 甚至还要看输出长度——输出超过 200 token,输出价能从 8 元跳到 14 元。
- **通义的缓存是一条通用规则而不是逐模型的价。**官方口径是:缓存命中按标准输入单价的 10% 计费,创建显式缓存按 125% 计费。所以上表通义那两行的命中价写的是规则而非具体数字。
- **限时折扣没有计入表内。**通义
qwen3.7-max现在挂限时 5 折、qwen3.7-plus限时 8 折,用的时候确实便宜,但做长期预算建议按原价算。
缓存折扣:谁的省钱力度最大
缓存是这几家里真正拉开成本差距的地方,标价本身反而没那么重要。但有个前提常被忽略:各家的”缓存折扣”根本不是同一个数量级,横评时套错会差出几十倍。
DeepSeek 的上下文硬盘缓存默认对所有用户开启,不用改代码。deepseek-v4-flash 命中价是未命中价的 2%,deepseek-v4-pro 是 0.83%,降幅都在 98%-99% 这个量级——这是五家里最狠的。缓存只匹配输入的前缀部分,输出照常按模型实际生成计费;官方说法是”尽力而为”,不保证 100% 命中,闲置缓存一般数小时到数天后自动清理。
Kimi 走自动上下文缓存,主力款的命中价大约是未命中价的 17%(kimi-k2.6 是 ¥1.10 对 ¥6.50)。但旗舰 kimi-k3 是个例外:¥2.00 对 ¥20.00,正好 10%,差距拉到 10 倍。K3 本身贵,把缓存吃好能把贵的那部分压回去不少。
通义千问这次拿到了明确的通用规则:命中按标准输入价的 10%,创建显式缓存按 125%。注意那个 125%——显式缓存不是白建的,得先多付 25% 建起来,之后每次命中才省 90%,所以它划不划算取决于同一段前缀会复用多少次。另外通义的缓存折扣和 Batch 五折不能同时生效,只能二选一。
智谱 GLM 这次也拿到了逐档的缓存命中价,力度大致是标价的 20%-25%(GLM-5.2 是 2÷8=25%,GLM-4.7 最低档是 0.4÷2=20%)。另外缓存存储费目前标注”限时免费”——现阶段只为命中的 token 付钱,不用为”存着”付钱,但”限时”两个字说明这不是永久承诺。GLM 的 Batch API 是明确的五折,这是批量异步折扣,跟缓存命中不是一回事。
豆包的命中价基本也是标价的两成(doubao-seed-2.1-pro 是 1.20 对 6.00)。有个细节很值得单拎出来:doubao-seed-code 的缓存命中价固定 0.24 元、不随输入长度跳档,所以输入落在最贵的档位时(标价 2.80 元),命中折扣反而放大到不足一折。长上下文的编程场景,这个特性收益很明显。另外豆包的批量推理表里保留了缓存命中价,也就是说批量和缓存在方舟可以同时吃,这跟通义”二选一”的规则不一样。
一句话总结折扣力度排序:DeepSeek(99%)> Kimi K3 / 通义(90%)> Kimi 主力款(83%)> GLM / 豆包(75%-80%)。
免费额度:能不能先零成本跑起来
智谱 GLM 这里最实在:GLM-4.7-Flash 在官方价目表里输入、输出、缓存三项全部标”免费”,200K 上下文,长期免费而非限时活动。想先跑通链路不花钱,优先选它。往上一档的 GLM-4.7-FlashX 是输入 0.5 元、输出 3 元,遇到免费档的并发限制时这是最自然的下一步。至于新用户赠送多少 token,网上说法不一(有说 2000 万、有说 1200 万+500 万),官方页面本次仍未核实到,别拿这个数字做预算依据。
通义千问新用户开通阿里云百炼会获赠免费额度,官方口径是各模型 100 万 Token、90 天有效期。但这次核到一条上一版漏掉、特别容易踩的限制:免费额度只在华北2(北京)地域提供,其他地域(新加坡、弗吉尼亚、法兰克福、东京)一律没有。如果你为了延迟或合规部署在新加坡节点,然后纳闷免费额度怎么没扣,多半就是这个原因。另外不同模型、乃至同一模型的不同快照版本,额度池都是独立的;这份额度不能抵扣 Batch、缓存、调优、部署,只顶实时推理。
豆包上一版写的”新用户 50 万 token 一次性额度”,本次没有在官方价格页复核到,这里如实标注:以你注册时控制台实际显示的为准。本次能确认的免费资源是另一笔——Managed Agents 首次开通赠送 30 小时 Agent 运行时 + 500 次 web_search,每账号一次,有效期 2 年。网上流传的”协作奖励计划每日 200 万 token”仍未获官方确认,不当定数。
DeepSeek 和 Kimi 这边依然没有查到类似”新用户赠送 token”的官方页面说明,这里不替它们编一个免费额度出来——如果你在控制台看到了赠送提示,以你账户里实际显示的为准。
一个新角度:同一个模型,换个渠道买价格差 4 倍
这次核实发现一件上一版完全没提、但很影响选型的事:火山方舟(豆包所在的平台)也转售 DeepSeek 和智谱的模型,而且价差很悬殊:
| 模型 | 原厂价(输入/输出/命中) | 火山方舟价(输入/输出/命中) |
|---|---|---|
deepseek-v4-pro | 3 / 6 / 0.025 | 12 / 24 / 1.00 |
deepseek-v4-flash | 1 / 2 / 0.02 | 1 / 2 / 0.20 |
glm-5.2 | 8 / 28 / 2 | 8 / 28 / 2(同价) |
GLM 在方舟上和智谱官方同价,DeepSeek 却贵得多:pro 档差整整 4 倍,flash 档标价虽同,但缓存命中价从 0.02 元变 0.20 元,差 10 倍——而缓存命中恰恰是 DeepSeek 最能省钱的地方。
这不是说方舟坑人,第三方转售要覆盖自己的成本,统一账单和控制台本身也有价值。但如果你选某个平台的理由是”上面能买到便宜的某某模型”,一定去比一眼原厂价,别拿着 A 家的单价去规划一个跑在 B 家平台上的账单。
能力定位与上下文:各家擅长什么
五家的技术路线和市场定位不一样,价格便宜不代表适合你的任务:
- DeepSeek:主打推理能力,V4 系列分 flash/pro 两档,全系 1M 上下文,走 OpenAI 兼容端点,老代码迁移基本只用换
base_url和api_key。缓存折扣是五家里最狠的。但要留意官方已预告”整体上调定价,预计涨幅较大”。 - Kimi:长上下文和长文档处理是老本行。旗舰
kimi-k3给到 1,048,576 上下文,kimi-k2.7-code定位编程,kimi-k2.6支持视觉与文本。Batch 是六折,但不支持 K3,批量任务用旗舰得付全价。 - 智谱 GLM:迭代非常快,
GLM-5.2是当前旗舰(1M 上下文)。产品矩阵从长期免费的 Flash 一直铺到旗舰,跨度是五家里最完整的,另有独立的编程订阅套餐(GLM Coding Plan),按额度/周期计费而非纯按量。 - 通义千问:模型矩阵最庞杂,经典命名(max/plus/flash/turbo/long)和 Qwen3 系列并存,还有 coder、VL、OCR、翻译、Omni 等垂类。生态绑定阿里云百炼,适合本来就在阿里云体系里的团队。注意
qwen-plus这类模型的思考模式输出价是非思考模式的 4 倍,且按”思维链+回答”一起计费。 - 豆包:背靠字节的火山方舟,Seed 系列走分段计费,
doubao-seed-code为编程场景做了三段定价且缓存命中价不跳档。最新的doubao-seed-evolving计费档拉到 [0,1024]。批量五折且能与缓存叠加,是五家里批量场景最划算的组合之一。
分场景选型结论
- 预算极度敏感、任务偏简单批量:GLM 的
GLM-4.7-Flash可以零成本跑通链路;真要处理大量调用,DeepSeek 的deepseek-v4-flash缓存命中后单价低到几乎可以忽略(0.02 元),配合批量任务的重复前缀效果最明显。豆包的doubao-seed-1.6-flash(0.15 元起、命中 0.03 元)也在同一梯队。 - 超长文档、整个代码库这类 1M 级任务:Kimi
kimi-k3(1,048,576)和 GLMGLM-5.2(1M)都够用,但两者旗舰溢价都很陡——K3 输出 100 元、GLM-5.2 输出 28 元。先看你的 P95 输入长度到底有多长,用不满 262K 就别为 1M 付钱,Kimi K2.5 或 GLM-4.7 更划算。 - 写代码、编程助手场景:
kimi-k2.7-code是官方专门定位的编程模型;豆包doubao-seed-code走三段定价,且缓存命中价固定 0.24 元不跳档,长上下文越用越划算;通义qwen3-coder-plus要特别小心——输入超过 256K 后输出价是 200 元,比前一档跳 5 倍,做 Agent 类长任务必须控上下文;GLM 有独立的 Coding Plan 订阅套餐,适合习惯订阅制的团队。 - 能接受异步的批量任务:GLM 和通义都是五折,豆包也是五折且能和缓存叠加,Kimi 是六折但不支持旗舰 K3。如果批量是你的主场景,豆包的”五折 + 缓存”组合和 DeepSeek 的”极低命中价”是两条最省钱的路。
- 通用场景、什么都要覆盖一点、想要生态省心:通义千问覆盖面最广,且和阿里云其他服务打通;但要留意限时折扣会到期、思考模式另算价、免费额度只有北京地域这三个坑。
- 正在做长期成本规划的团队:别只比标价。把各家的缓存折扣力度(差到 20 倍以上)、免费额度能不能覆盖你的高频场景、分段/阶梯计价会不会因为你的输入长度经常跨档而多花钱、以及 DeepSeek 那条涨价预告,按自己真实的调用模式代进去算一遍,比单看单价表靠谱得多。
常见坑 / 注意
- 分段/阶梯计价不是”买得多越便宜”:通义、豆包、GLM 都按输入长度分档,超过临界点这次请求(含输出)整体按更贵的档位结算,不是超出部分单独加价,预算时留足余量。
- 输出长度也可能跳档:GLM-4.7 输出超 200 token 从 8 元跳到 14 元,豆包
seed-1.6-lite同理。短输出任务卡住max_tokens能实打实省钱。 - 缓存折扣力度差到 20 倍以上:DeepSeek 命中降幅约 98%-99%,通义和 Kimi K3 约 90%,Kimi 主力款约 83%,GLM 和豆包约 75%-80%。别拿一家的力度套另一家。
- 思考模式是另一套价:通义
qwen-plus非思考输出 2 元、思考 8 元,且按”思维链+回答”计费——那些你可能根本不展示给用户的推理过程照样收钱。 - 限时折扣会到期:通义部分型号现在挂着 5 折、8 折,按原价做长期预算更安全。
- DeepSeek 已预告涨价:官方文档原文写明”计划近期整体上调定价,预计涨幅较大”,未给幅度和日期。现价仍有效,但保质期可能不长。
- 免费额度大多不覆盖批量和缓存:通义、豆包的免费额度都明确排除 Batch,通义的还只在北京地域才有。
moonshot-v1系列 8 月 31 日下线:老项目跑在这条线上的现在就该排迁移。- 别拿 A 家单价规划 B 家平台的账单:同一个模型在不同渠道能差 4 倍,选平台前比一眼原厂价。
- 动态渲染的定价页不等于没公布:GLM 和火山方舟的价格页都是 JS 渲染的,简单抓取会拿到空壳,自己核实时用浏览器真正打开看。
接下来看什么
留言讨论
评论发布后会被人工复核,违规内容将被删除。
如果发表没有反应,可以前往联系我们告诉我们。