国产大模型 API 价格对比:DeepSeek/Kimi/GLM/通义/豆包怎么选

2026-07-07 · 更新于 2026-08-09
站内工具 大模型 API 价格对比表 → 豆包 / GLM / Kimi / 千问 / DeepSeek 等 9 家厂商单价并排看,可按币种筛选、按价格排序,每行链到官方定价页。

数据截至 2026-08-09,价格与限额以各官网为准。本次更新逐一重打开了五家官网定价页(含用浏览器渲染此前抓不到的动态页面)。

先说结论:预算极度敏感、能接受批量/异步的活儿,DeepSeek 的缓存命中价和 GLM 的免费档几乎是白菜价;要处理超长文档,Kimi K3 和 GLM-5.2 都给到了 1M 上下文,但旗舰溢价很陡,先确认你真用得上;写代码,Kimi 的 K2.7-code 和豆包的 seed-code 都做了专门定价,后者的缓存命中价不跳档、长上下文特别划算;生态在阿里云、任务类型杂,通义千问的矩阵最全,但要留意限时折扣会到期。没有哪一家在所有维度都赢,先看自己最常跑的那类任务,再对着下面的表挑。

这一版更新了什么

这篇上一版写于 2026 年 7 月初,一个月后重核,发现过时的不只是型号名,还有几处结构性的变化:

  • GLM 已经不是固定单价了,旗舰全系改成按输入长度(部分还看输出长度)分段计价,上一版”固定单价”的定性是错的;
  • GLM 的完整价目表这次拿到了。上一版因为官网定价页是 JS 渲染、抓取拿到空壳,只能标”未核实、请自行核对”,这次用浏览器渲染后读到了官方原文数字,那些留白全部补上;
  • Kimi 的旗舰换成了 K3(1M 上下文),K2.6 退居多模态款;经典的 moonshot-v1 系列官方预告 8 月 31 日全平台下线;
  • 通义的主力换成了 qwen3.8-max / qwen3.7-plus,且部分型号正挂着限时 5 折、8 折;
  • DeepSeek 官方文档里出现了涨价预告:“计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大”;
  • 豆包的官方价格总表这次也拿到了,上一版靠第三方转述交叉印证的数字得以核准。

先声明一句:这篇比的是什么

这篇比的是五家 API 的调用成本——每百万 token 输入/输出多少钱、缓存折扣力度、免费额度规则,全部是能直接拿去算账单的硬数字。它不是对话产品体验横评,不涉及”哪家聊天更好用""谁的回答更聪明”这类主观感受。如果你想看的是 DeepSeek、Kimi、豆包三款对话工具日常用起来谁更顺手,去看 DeepSeek vs Kimi vs 豆包:国产对话工具怎么选,那篇讲的是产品体验,这篇讲的是接口账单。两篇角度不同,别搞混。

价格总表:每家旗舰与性价比档各一行

统一口径说明:以下全部是人民币,且全部来自各家中国大陆站官方页面——DeepSeek、GLM、通义千问、豆包本身就是人民币定价,Kimi 则取大陆站 platform.kimi.com 的价格(它还有一个美元计价的国际站 platform.kimi.ai,两套账户体系不互通,本文不混用)。

分段/阶梯计价的模型,表里给的是最低档的价格,后面标了跳档情况。

厂商档位代表模型输入(元/百万)缓存命中输出(元/百万)上下文 / 计费档
DeepSeek旗舰deepseek-v4-pro30.02561M
DeepSeek性价比deepseek-v4-flash10.0221M
Kimi旗舰kimi-k3202.001001,048,576
Kimi性价比kimi-k2.54.000.7021.00262,144
智谱 GLM旗舰GLM-5.282281M
智谱 GLM性价比GLM-4.7-Flash免费免费免费200K
通义千问旗舰qwen3.8-max12按输入价 10%36计费档至 1M
通义千问性价比qwen3.7-flash0.2(最低档)按输入价 10%0.8(最低档)计费档至 1M
豆包旗舰doubao-seed-2.1-pro6.001.2030.00计费档 [0,256]
豆包性价比doubao-seed-1.6-flash0.15(最低档)0.031.50(最低档)计费档 [0,256]

几个必须提前说清楚的口径细节,不然这张表容易看错:

  • “上下文 / 计费档”这一列要分两种读法。DeepSeek、Kimi、GLM 那几行是官方标注的上下文窗口;通义和豆包那几行是计费阶梯的区间上限,它反映的是”价格分档分到多长”,不能直接等同于官方标称的最大上下文。要用准确的窗口数字,去对应的模型详情页看。
  • **三家的最低档不是它的常态价。**通义 qwen3.7-flash 的 0.2 元只在输入不到 32K 时有效,超过就变 0.6 元、再超变 1.2 元;豆包 doubao-seed-1.6-flash 同理(0.15→0.30→0.60)。跳档时整次请求(含输出)都按新档结算,不是超出部分单独加价,这点对长上下文场景杀伤力很大。
  • **GLM 现在也是分段计价了。**表里的 GLM-5.2 是全量单价没错,但 GLM-5.1、GLM-5、GLM-4.7 都按输入长度分两到三档,GLM-4.7 和 GLM-4.5-Air 甚至还要看输出长度——输出超过 200 token,输出价能从 8 元跳到 14 元。
  • **通义的缓存是一条通用规则而不是逐模型的价。**官方口径是:缓存命中按标准输入单价的 10% 计费,创建显式缓存按 125% 计费。所以上表通义那两行的命中价写的是规则而非具体数字。
  • **限时折扣没有计入表内。**通义 qwen3.7-max 现在挂限时 5 折、qwen3.7-plus 限时 8 折,用的时候确实便宜,但做长期预算建议按原价算。

缓存折扣:谁的省钱力度最大

缓存是这几家里真正拉开成本差距的地方,标价本身反而没那么重要。但有个前提常被忽略:各家的”缓存折扣”根本不是同一个数量级,横评时套错会差出几十倍。

DeepSeek 的上下文硬盘缓存默认对所有用户开启,不用改代码。deepseek-v4-flash 命中价是未命中价的 2%,deepseek-v4-pro 是 0.83%,降幅都在 98%-99% 这个量级——这是五家里最狠的。缓存只匹配输入的前缀部分,输出照常按模型实际生成计费;官方说法是”尽力而为”,不保证 100% 命中,闲置缓存一般数小时到数天后自动清理。

Kimi 走自动上下文缓存,主力款的命中价大约是未命中价的 17%(kimi-k2.6 是 ¥1.10 对 ¥6.50)。但旗舰 kimi-k3 是个例外:¥2.00 对 ¥20.00,正好 10%,差距拉到 10 倍。K3 本身贵,把缓存吃好能把贵的那部分压回去不少。

通义千问这次拿到了明确的通用规则:命中按标准输入价的 10%,创建显式缓存按 125%。注意那个 125%——显式缓存不是白建的,得先多付 25% 建起来,之后每次命中才省 90%,所以它划不划算取决于同一段前缀会复用多少次。另外通义的缓存折扣和 Batch 五折不能同时生效,只能二选一。

智谱 GLM 这次也拿到了逐档的缓存命中价,力度大致是标价的 20%-25%(GLM-5.2 是 2÷8=25%,GLM-4.7 最低档是 0.4÷2=20%)。另外缓存存储费目前标注”限时免费”——现阶段只为命中的 token 付钱,不用为”存着”付钱,但”限时”两个字说明这不是永久承诺。GLM 的 Batch API 是明确的五折,这是批量异步折扣,跟缓存命中不是一回事。

豆包的命中价基本也是标价的两成(doubao-seed-2.1-pro 是 1.20 对 6.00)。有个细节很值得单拎出来:doubao-seed-code 的缓存命中价固定 0.24 元、不随输入长度跳档,所以输入落在最贵的档位时(标价 2.80 元),命中折扣反而放大到不足一折。长上下文的编程场景,这个特性收益很明显。另外豆包的批量推理表里保留了缓存命中价,也就是说批量和缓存在方舟可以同时吃,这跟通义”二选一”的规则不一样。

一句话总结折扣力度排序:DeepSeek(99%)> Kimi K3 / 通义(90%)> Kimi 主力款(83%)> GLM / 豆包(75%-80%)

免费额度:能不能先零成本跑起来

智谱 GLM 这里最实在:GLM-4.7-Flash 在官方价目表里输入、输出、缓存三项全部标”免费”,200K 上下文,长期免费而非限时活动。想先跑通链路不花钱,优先选它。往上一档的 GLM-4.7-FlashX 是输入 0.5 元、输出 3 元,遇到免费档的并发限制时这是最自然的下一步。至于新用户赠送多少 token,网上说法不一(有说 2000 万、有说 1200 万+500 万),官方页面本次仍未核实到,别拿这个数字做预算依据。

通义千问新用户开通阿里云百炼会获赠免费额度,官方口径是各模型 100 万 Token、90 天有效期。但这次核到一条上一版漏掉、特别容易踩的限制:免费额度只在华北2(北京)地域提供,其他地域(新加坡、弗吉尼亚、法兰克福、东京)一律没有。如果你为了延迟或合规部署在新加坡节点,然后纳闷免费额度怎么没扣,多半就是这个原因。另外不同模型、乃至同一模型的不同快照版本,额度池都是独立的;这份额度不能抵扣 Batch、缓存、调优、部署,只顶实时推理。

豆包上一版写的”新用户 50 万 token 一次性额度”,本次没有在官方价格页复核到,这里如实标注:以你注册时控制台实际显示的为准。本次能确认的免费资源是另一笔——Managed Agents 首次开通赠送 30 小时 Agent 运行时 + 500 次 web_search,每账号一次,有效期 2 年。网上流传的”协作奖励计划每日 200 万 token”仍未获官方确认,不当定数。

DeepSeek 和 Kimi 这边依然没有查到类似”新用户赠送 token”的官方页面说明,这里不替它们编一个免费额度出来——如果你在控制台看到了赠送提示,以你账户里实际显示的为准。

一个新角度:同一个模型,换个渠道买价格差 4 倍

这次核实发现一件上一版完全没提、但很影响选型的事:火山方舟(豆包所在的平台)也转售 DeepSeek 和智谱的模型,而且价差很悬殊:

模型原厂价(输入/输出/命中)火山方舟价(输入/输出/命中)
deepseek-v4-pro3 / 6 / 0.02512 / 24 / 1.00
deepseek-v4-flash1 / 2 / 0.021 / 2 / 0.20
glm-5.28 / 28 / 28 / 28 / 2(同价)

GLM 在方舟上和智谱官方同价,DeepSeek 却贵得多:pro 档差整整 4 倍,flash 档标价虽同,但缓存命中价从 0.02 元变 0.20 元,差 10 倍——而缓存命中恰恰是 DeepSeek 最能省钱的地方。

这不是说方舟坑人,第三方转售要覆盖自己的成本,统一账单和控制台本身也有价值。但如果你选某个平台的理由是”上面能买到便宜的某某模型”,一定去比一眼原厂价,别拿着 A 家的单价去规划一个跑在 B 家平台上的账单。

能力定位与上下文:各家擅长什么

五家的技术路线和市场定位不一样,价格便宜不代表适合你的任务:

  • DeepSeek:主打推理能力,V4 系列分 flash/pro 两档,全系 1M 上下文,走 OpenAI 兼容端点,老代码迁移基本只用换 base_urlapi_key。缓存折扣是五家里最狠的。但要留意官方已预告”整体上调定价,预计涨幅较大”。
  • Kimi:长上下文和长文档处理是老本行。旗舰 kimi-k3 给到 1,048,576 上下文,kimi-k2.7-code 定位编程,kimi-k2.6 支持视觉与文本。Batch 是六折,但不支持 K3,批量任务用旗舰得付全价。
  • 智谱 GLM:迭代非常快,GLM-5.2 是当前旗舰(1M 上下文)。产品矩阵从长期免费的 Flash 一直铺到旗舰,跨度是五家里最完整的,另有独立的编程订阅套餐(GLM Coding Plan),按额度/周期计费而非纯按量。
  • 通义千问:模型矩阵最庞杂,经典命名(max/plus/flash/turbo/long)和 Qwen3 系列并存,还有 coder、VL、OCR、翻译、Omni 等垂类。生态绑定阿里云百炼,适合本来就在阿里云体系里的团队。注意 qwen-plus 这类模型的思考模式输出价是非思考模式的 4 倍,且按”思维链+回答”一起计费。
  • 豆包:背靠字节的火山方舟,Seed 系列走分段计费,doubao-seed-code 为编程场景做了三段定价且缓存命中价不跳档。最新的 doubao-seed-evolving 计费档拉到 [0,1024]。批量五折且能与缓存叠加,是五家里批量场景最划算的组合之一。

分场景选型结论

  • 预算极度敏感、任务偏简单批量:GLM 的 GLM-4.7-Flash 可以零成本跑通链路;真要处理大量调用,DeepSeek 的 deepseek-v4-flash 缓存命中后单价低到几乎可以忽略(0.02 元),配合批量任务的重复前缀效果最明显。豆包的 doubao-seed-1.6-flash(0.15 元起、命中 0.03 元)也在同一梯队。
  • 超长文档、整个代码库这类 1M 级任务:Kimi kimi-k3(1,048,576)和 GLM GLM-5.2(1M)都够用,但两者旗舰溢价都很陡——K3 输出 100 元、GLM-5.2 输出 28 元。先看你的 P95 输入长度到底有多长,用不满 262K 就别为 1M 付钱,Kimi K2.5 或 GLM-4.7 更划算。
  • 写代码、编程助手场景kimi-k2.7-code 是官方专门定位的编程模型;豆包 doubao-seed-code 走三段定价,且缓存命中价固定 0.24 元不跳档,长上下文越用越划算;通义 qwen3-coder-plus 要特别小心——输入超过 256K 后输出价是 200 元,比前一档跳 5 倍,做 Agent 类长任务必须控上下文;GLM 有独立的 Coding Plan 订阅套餐,适合习惯订阅制的团队。
  • 能接受异步的批量任务:GLM 和通义都是五折,豆包也是五折且能和缓存叠加,Kimi 是六折但不支持旗舰 K3。如果批量是你的主场景,豆包的”五折 + 缓存”组合和 DeepSeek 的”极低命中价”是两条最省钱的路。
  • 通用场景、什么都要覆盖一点、想要生态省心:通义千问覆盖面最广,且和阿里云其他服务打通;但要留意限时折扣会到期、思考模式另算价、免费额度只有北京地域这三个坑。
  • 正在做长期成本规划的团队:别只比标价。把各家的缓存折扣力度(差到 20 倍以上)、免费额度能不能覆盖你的高频场景、分段/阶梯计价会不会因为你的输入长度经常跨档而多花钱、以及 DeepSeek 那条涨价预告,按自己真实的调用模式代进去算一遍,比单看单价表靠谱得多。

常见坑 / 注意

  • 分段/阶梯计价不是”买得多越便宜”:通义、豆包、GLM 都按输入长度分档,超过临界点这次请求(含输出)整体按更贵的档位结算,不是超出部分单独加价,预算时留足余量。
  • 输出长度也可能跳档:GLM-4.7 输出超 200 token 从 8 元跳到 14 元,豆包 seed-1.6-lite 同理。短输出任务卡住 max_tokens 能实打实省钱。
  • 缓存折扣力度差到 20 倍以上:DeepSeek 命中降幅约 98%-99%,通义和 Kimi K3 约 90%,Kimi 主力款约 83%,GLM 和豆包约 75%-80%。别拿一家的力度套另一家。
  • 思考模式是另一套价:通义 qwen-plus 非思考输出 2 元、思考 8 元,且按”思维链+回答”计费——那些你可能根本不展示给用户的推理过程照样收钱。
  • 限时折扣会到期:通义部分型号现在挂着 5 折、8 折,按原价做长期预算更安全。
  • DeepSeek 已预告涨价:官方文档原文写明”计划近期整体上调定价,预计涨幅较大”,未给幅度和日期。现价仍有效,但保质期可能不长。
  • 免费额度大多不覆盖批量和缓存:通义、豆包的免费额度都明确排除 Batch,通义的还只在北京地域才有。
  • moonshot-v1 系列 8 月 31 日下线:老项目跑在这条线上的现在就该排迁移。
  • 别拿 A 家单价规划 B 家平台的账单:同一个模型在不同渠道能差 4 倍,选平台前比一眼原厂价。
  • 动态渲染的定价页不等于没公布:GLM 和火山方舟的价格页都是 JS 渲染的,简单抓取会拿到空壳,自己核实时用浏览器真正打开看。

接下来看什么

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。

留言讨论

评论发布后会被人工复核,违规内容将被删除。

    还没有人评论,来说说你的看法

    如果发表没有反应,可以前往联系我们告诉我们。

    这个页面有问题?

    提交时会附带当前页面地址和浏览器信息,帮助我们定位问题。不填联系方式即为匿名。