在线计算器

大模型 API 价格对比表:豆包 / GLM / Kimi / 千问 / DeepSeek 等主流厂商单价

每百万 token 的输入/输出单价。当前收录 24 个模型、9 家厂商(海外 4 家 + 国内 5 家),每行按官方原文币种标注,可点开官方定价页核对。

共 24 个模型
模型厂商输入价(每百万 token) ↕输出价(每百万 token) ↕上下文多模态备注来源 / 核对日
gpt-6-astraOpenAI$10$50以官方文档为准—Standard 档短上下文价;长上下文档为 $20/$75,表内取下限。缓存命中输入 $1、缓存写入 $12.50;Batch/Flex 半价,Fast mode 两倍OpenAI 官方2026-09-28
gpt-6-solOpenAI$2$10以官方文档为准—Standard 档短上下文价;长上下文档为 $4/$15,表内取下限。缓存命中输入 $0.20、缓存写入 $2.50;Batch/Flex 半价,Fast mode 两倍OpenAI 官方2026-09-28
gpt-6-lunaOpenAI$0.1$0.5以官方文档为准—Standard 档短上下文价;长上下文档为 $0.20/$0.75,表内取下限。缓存命中输入 $0.01、缓存写入 $0.125;该系列最便宜档OpenAI 官方2026-09-28
Claude Fable 5.1Anthropic$10$501M—缓存命中 $0.25;5 分钟缓存写入 $12.50、1 小时 $20;Batch 五折;官方写明 Claude 4.6 及之后的模型 1M 上下文全程按标准价Anthropic 官方2026-09-28
Claude Opus 5.5Anthropic$4$201M—缓存命中 $0.20;5 分钟缓存写入 $5、1 小时 $8;Batch 五折Anthropic 官方2026-09-28
Claude Sonnet 5Anthropic$2$101M—缓存命中 $0.20;5 分钟缓存写入 $2.50、1 小时 $4;Batch 五折Anthropic 官方2026-09-28
Claude Haiku 4.5Anthropic$1$5以官方文档为准—缓存命中 $0.10;5 分钟缓存写入 $1.25、1 小时 $2;该系列最便宜档Anthropic 官方2026-09-28
Gemini 3.8 FlashGoogle$1.5$7.5以官方文档为准是付费层 2027-01-01 起的标准价;当前为限时价 $0.75/$3.75(至 2026-12-31)。缓存命中同期 $0.075,之后 $0.15;Batch 五折Google 官方2026-09-28
Gemini 3.1 Pro(Preview)Google$2$12以官方文档为准是按 prompt 长度分档:≤20 万 token 为 $2/$12,>20 万 token 为 $4/$18,表内取下限;Batch 五折;Preview 阶段价格可能调整Google 官方2026-09-28
Gemini 3.5 Flash-LiteGoogle$0.3$2.5以官方文档为准是官方描述为面向大批量任务的高性价比模型;Batch 五折($0.15/$1.25)Google 官方2026-09-28
grok-4.7xAI$2$6500K—官方当前旗舰;超过 200K 的长上下文请求为 $4/$12。缓存命中 $0.50(长上下文 $1)xAI 官方2026-09-28
deepseek-flashDeepSeek¥2¥81M是模型版本 DeepSeek-V4.1-Flash;旧名 deepseek-v4-flash 仍可调用,由 V4.1-Flash 服务并按 Flash 计价。表内为高峰时段价(工作日 9:00-12:00、14:00-18:00),其余时段半价(¥1/¥4)。缓存命中输入高峰 ¥0.04、空闲 ¥0.02DeepSeek 官方2026-09-28
deepseek-v4-proDeepSeek¥9¥271M否模型版本 DeepSeek-V4-Pro-0813;官方标注不支持图像理解。表内为高峰时段价,其余时段半价(¥4.5/¥13.5)。缓存命中输入高峰 ¥0.30、空闲 ¥0.15DeepSeek 官方2026-09-28
GLM-5.3智谱AI¥8¥281M—官方标注最新旗舰;缓存命中 ¥2;缓存存储限时免费;Batch 五折智谱开放平台2026-09-28
GLM-5.2智谱AI¥8¥281M—缓存命中 ¥2;缓存存储官方标注限时免费智谱开放平台2026-09-28
GLM-5.3-Flash智谱AI¥0.8¥2.81M是标准价;官方当前限时五折(¥0.4/¥1.4)。缓存命中 ¥0.23;原生多模态,支持图片、视频、文件输入。同系列 GLM-4.7-Flash 官方标注免费智谱开放平台2026-09-28
kimi-k3月之暗面¥20¥1001M(1,048,576 tokens)—缓存命中输入 ¥2,与未命中价差 10 倍;缓存写入按 TTL 另计,5 分钟档 ¥20、1 小时档 ¥40Kimi 开放平台2026-09-28
kimi-k2.7-code月之暗面¥6.5¥27256K(262,144 tokens)是缓存命中输入 ¥1.3;官方标注支持文本、图片与视频输入;高速版 kimi-k2.7-code-highspeed 为 ¥13/¥54Kimi 开放平台2026-09-28
qwen3.8-max阿里云¥12¥361M—0–1M token 单一档、不分段;Batch 调用半价,上下文缓存另有折扣(两者不能同时生效)阿里云百炼2026-09-28
qwen3.7-plus阿里云¥2¥81M—按输入长度分档:≤256K 为 ¥2/¥8,256K–1M 为 ¥6/¥24,表内取下限;官方另标注限时 8 折;Batch 半价阿里云百炼2026-09-28
qwen3.7-flash阿里云¥0.2¥0.81M—按输入长度分档:≤32K 为 ¥0.2/¥0.8,32K–256K 为 ¥0.6/¥2.4,256K–1M 为 ¥1.2/¥4.8,表内取下限;Batch 半价阿里云百炼2026-09-28
doubao-seed-2.1-pro字节跳动¥6¥30以官方文档为准—输入长度 0–1024K 单一档;缓存命中 ¥1.2,缓存存储 ¥0.017/百万 token/小时火山方舟2026-09-28
doubao-seed-2.1-turbo字节跳动¥3¥15以官方文档为准—输入长度 ≤256K 档价;缓存命中 ¥0.6火山方舟2026-09-28
doubao-seed-2.0-mini字节跳动¥0.2¥2以官方文档为准—按输入长度分档:≤32K 为 ¥0.2/¥2,32K–128K 为 ¥0.4/¥4,128K–256K 为 ¥0.8/¥8,表内取下限;音频输入另计价(¥3 起)火山方舟2026-09-28

最近一次逐条核对官方定价页:2026-09-28。表内 $ 为海外厂商官方美元价、¥ 为国内厂商人民币刊例价,均为官方原文,未做任何折算; 点表头排序时按 1 美元 ≈ 6.7133 人民币(2026-09-28 取数)折算比较,仅影响行序。价格随时可能调整,做预算前请点开来源链接现场确认。

这张表的每个数字都能点开验

搜「大模型 API 价格对比」能翻出几十张表,行数一张比一张多,但很少有哪张告诉你数字是从哪来的、什么时候核的。 结果就是:你照着表做完预算,一调用发现价格早改了,或者那个型号根本已经下线。

所以这张表定了一条硬规矩:只收录能在厂商官方定价页上逐字查到的条目, 每一行必须带官方链接和核对日期,核不到官方原文的厂商宁可空着。 现在收录了 9 家——海外 4 家(OpenAI、Anthropic、Google、xAI), 国内 5 家(DeepSeek、智谱、月之暗面、阿里云百炼、火山方舟), 每家取 1–3 个当前在售的主力档,不堆型号数凑长度。

没收录的也说清楚原因。腾讯混元的公开文档页已经公告原平台不再新增模型能力、停止支持新购模型服务, 主力语言模型的定价迁到了需要登录的 TokenHub 控制台。读者自己打不开去复核的价格,我们就不往表里放。 等它有了公开可查的定价页,再补进来。

读这张表要注意的五件事

零、别拿 $ 和 ¥ 直接比大小。表里海外几家标美元、国内几家标人民币,都是各自官方定价页上的原文。 看着 DeepSeek 输入 ¥1、Gemini 3.5 Flash-Lite 输入 $0.3,前者数字大,实际按 2026-09-28 的汇率折下来 反而是 DeepSeek 更便宜。想跨国比,点表头让它按折算后的值排序,或者直接去 月成本估算器选个结算币种算总账。

一、刊例价不等于你的实际单价。多数厂商都有缓存命中折扣(重复的前缀输入按低价计), Batch 批处理通常打五折,量大还能谈。反过来也有涨的:有的厂商公布了峰谷定价,高峰时段单价翻倍。 表里的数字是标准档,折扣和溢价写在备注列里。

二、区间价取的是下限。有些模型按 prompt 长度分档,比如输入价标成一个区间, 短提示走低档、长提示走高档。表里为了可排序取了下限,完整区间写在备注里—— 如果你的场景是长上下文,请按上限估。

三、输出价通常是输入价的几倍。只盯输入价选型会选错。 真实成本取决于你的输入输出比:做摘要(长输入短输出)和做生成(短输入长输出),最优解常常不是同一个模型。 把两个数一起代进月成本估算器再排序,比肉眼比价靠谱。

四、分词器差异会吃掉一部分价格优势。单价低但中文分词更碎的模型, 同样一段中文会切出更多 token,实际账单未必更省。可以先用 token 计算器估一下你的典型文本量级,心里有个底。

国产模型的价格为什么一行装不下

国产厂商的定价页普遍比海外复杂:同一个模型按输入长度分成好几档, 有的还区分「思考模式」和普通模式、区分单价与阶梯包、限时活动价和刊例价混排。 比如 qwen3.7-flash 就分三档,从 ¥0.2/¥0.8 一路到 ¥1.2/¥4.8,差六倍; GLM-5 跨过 32K 输入就从 ¥4/¥18 跳到 ¥6/¥22。

抄成一行数字必然失真,所以表里统一取最低档做可排序的锚点, 把完整分档规则原样写进备注列。你的场景如果是长上下文,请直接按备注里的高档估, 别拿表里那个最低价做预算。想看各家计费口径的逐条拆解,可以读 国产大模型 API 价格对比那篇。

常见问题

为什么表里有的价格标 $、有的标 ¥?

因为厂商官方就是这么标的。海外几家的定价页写的是美元,国内几家写的是人民币刊例价。我们坚持按官方原文的币种记录,不做折算后再存——一旦折算,你看到的就不再是厂商说过的数字,而是我们按某天汇率算出来的数字。想只看一侧时,用表格上方的「币种」筛选器切换即可。

既然不折算,怎么跨国比价?

点表头排序时,我们内部会按 1 美元 ≈ 6.7133 人民币(2026-09-28 取数)把两边折到同一基准来决定行的先后,但显示出来的永远是官方原价。要按你自己的用量算总账,去月成本估算器,那里可以选结算币种,页面会明写用的是哪个汇率。汇率天天在动,这类折算只用来判断量级,别当报价用。

为什么没有腾讯混元 / 百度文心?

因为核不到公开的官方现价。腾讯混元的公开文档页已公告原平台不再新增模型能力、停止支持新购模型服务,主力语言模型的定价迁到了需要登录的 TokenHub 控制台;我们不列需要登录才能看到、读者无法自行复核的价格。本表的硬规矩是:只收录能在厂商官方定价页上逐字查到的条目,核不到就空着,绝不用第三方转述价补位。

表里的价格能直接拿去做预算吗?

可以做量级判断,不能当合同价。分档计费(按上下文长度跳档)、缓存命中折扣、Batch 五折、Preview 阶段调价、峰谷定价,都会让实际账单偏离刊例价。做正式预算前请点开对应的官方来源链接现场确认。

选好模型之后,下一步是接进来

各家 API 的密钥申请、SDK 调用、报错排查,奇连 AI 按厂商写好了逐篇教程。

去学习中心

这个页面有问题?

提交时会附带当前页面地址和浏览器信息,帮助我们定位问题。不填联系方式即为匿名。