在线计算器

大模型 API 价格对比表

每百万 token 的输入/输出单价。当前收录 23 个模型、9 家厂商(海外 4 家 + 国内 5 家),每行按官方原文币种标注,可点开官方定价页核对。

23 个模型
模型厂商输入价(每百万 token输出价(每百万 token上下文多模态备注来源 / 核对日
gpt-5.6-solOpenAI$5$30以官方文档为准短上下文档价;长上下文档为 $10/$45,表内取下限。缓存命中输入 $0.50、缓存写入 $6.25;Batch/Flex 档另有价OpenAI 官方2026-08-09
gpt-5.6-terraOpenAI$2$12以官方文档为准短上下文档价;长上下文档为 $4/$18,表内取下限。缓存命中输入 $0.20OpenAI 官方2026-08-09
gpt-5.6-lunaOpenAI$0.2$1.2以官方文档为准短上下文档价;长上下文档为 $0.40/$1.80,表内取下限。缓存命中输入 $0.02;该系列最便宜档OpenAI 官方2026-08-09
Claude Opus 5Anthropic$5$25以官方文档为准缓存命中 $0.50;5 分钟缓存写入 $6.25、1 小时 $10Anthropic 官方2026-08-09
Claude Sonnet 5Anthropic$2$10以官方文档为准官方标注为限时引导价,2026-08-31 前有效;2026-09-01 起恢复标准价 $3/$15。缓存命中 $0.20Anthropic 官方2026-08-09
Claude Haiku 4.5Anthropic$1$5以官方文档为准缓存命中 $0.10;该系列最便宜档Anthropic 官方2026-08-09
Gemini 3.6 FlashGoogle$1.5$7.5以官方文档为准付费层级价;Batch API 五折($0.75/$3.75);上下文缓存存储 $1.00/百万 token/小时Google 官方2026-08-09
Gemini 3.1 Pro(Preview)Google$2$12以官方文档为准按 prompt 长度分档:≤20 万 token 为 $2/$12,>20 万 token 为 $4/$18,表内取下限;Batch 五折;Preview 阶段价格可能调整Google 官方2026-08-09
Gemini 3.5 Flash-LiteGoogle$0.3$2.5以官方文档为准官方标为最具成本效益的正式版档;Batch 五折($0.15/$1.25)Google 官方2026-08-09
grok-4.5xAI$2$6500K官方当前主推的唯一旗舰文本模型(语音、图像视频为独立 API 另计费)xAI 官方2026-08-09
deepseek-v4-flashDeepSeek¥1¥21M缓存命中输入 ¥0.02。官方已公告近期将整体上调 API 定价、预计涨幅较大,做长期预算前务必复核DeepSeek 官方2026-08-09
deepseek-v4-proDeepSeek¥3¥61M缓存命中输入 ¥0.025。官方涨价公告同上DeepSeek 官方2026-08-09
GLM-5.2智谱AI¥8¥281M缓存命中 ¥2;缓存存储官方标注限时免费智谱开放平台2026-08-09
GLM-5智谱AI¥4¥18以官方文档为准按输入长度分档:<32K 为 ¥4/¥18,≥32K 为 ¥6/¥22,表内取下限;缓存命中 ¥1智谱开放平台2026-08-09
GLM-4.7-FlashX智谱AI¥0.5¥3200K缓存命中 ¥0.1;同系列 GLM-4.7-Flash 官方标注为免费智谱开放平台2026-08-09
kimi-k3月之暗面¥20¥1001M(1,048,576 tokens)缓存命中输入 ¥2,与未命中价差 10 倍,长会话务必开自动上下文缓存Kimi 开放平台2026-08-09
kimi-k2.7-code月之暗面¥6.5¥27256K(262,144 tokens)缓存命中输入 ¥1.3;官方标注支持文本、图片与视频输入;高速版 kimi-k2.7-code-highspeed 为 ¥13/¥54Kimi 开放平台2026-08-09
qwen3.8-max阿里云¥12¥361M0–1M token 单一档、不分段;Batch 调用半价,上下文缓存另有折扣(两者不能同时生效)阿里云百炼2026-08-09
qwen3.7-plus阿里云¥2¥81M按输入长度分档:≤256K 为 ¥2/¥8,256K–1M 为 ¥6/¥24,表内取下限;官方另标注限时 8 折;Batch 半价阿里云百炼2026-08-09
qwen3.7-flash阿里云¥0.2¥0.81M按输入长度分档:≤32K 为 ¥0.2/¥0.8,32K–256K 为 ¥0.6/¥2.4,256K–1M 为 ¥1.2/¥4.8,表内取下限;Batch 半价阿里云百炼2026-08-09
doubao-seed-2.1-pro字节跳动¥6¥30以官方文档为准输入长度 ≤256K 档价;缓存命中 ¥1.2,缓存存储 ¥0.017/百万 token/小时火山方舟2026-08-09
doubao-seed-2.1-turbo字节跳动¥3¥15以官方文档为准输入长度 ≤256K 档价;缓存命中 ¥0.6火山方舟2026-08-09
doubao-seed-2.0-mini字节跳动¥0.2¥2以官方文档为准按输入长度分档:≤32K 为 ¥0.2/¥2,32K–128K 为 ¥0.4/¥4,128K–256K 为 ¥0.8/¥8,表内取下限;音频输入另计价(¥3 起)火山方舟2026-08-09

最近一次逐条核对官方定价页:2026-08-09。表内 $ 为海外厂商官方美元价、¥ 为国内厂商人民币刊例价,均为官方原文,未做任何折算; 点表头排序时按 1 美元 ≈ 6.7476 人民币(2026-08-09 取数)折算比较,仅影响行序。价格随时可能调整,做预算前请点开来源链接现场确认。

这张表的每个数字都能点开验

搜「大模型 API 价格对比」能翻出几十张表,行数一张比一张多,但很少有哪张告诉你数字是从哪来的、什么时候核的。 结果就是:你照着表做完预算,一调用发现价格早改了,或者那个型号根本已经下线。

所以这张表定了一条硬规矩:只收录能在厂商官方定价页上逐字查到的条目, 每一行必须带官方链接和核对日期,核不到官方原文的厂商宁可空着。 现在收录了 9 家——海外 4 家(OpenAI、Anthropic、Google、xAI), 国内 5 家(DeepSeek、智谱、月之暗面、阿里云百炼、火山方舟), 每家取 1–3 个当前在售的主力档,不堆型号数凑长度。

没收录的也说清楚原因。腾讯混元的公开文档页已经公告原平台不再新增模型能力、停止支持新购模型服务, 主力语言模型的定价迁到了需要登录的 TokenHub 控制台。读者自己打不开去复核的价格,我们就不往表里放。 等它有了公开可查的定价页,再补进来。

读这张表要注意的五件事

零、别拿 $ 和 ¥ 直接比大小。表里海外几家标美元、国内几家标人民币,都是各自官方定价页上的原文。 看着 DeepSeek 输入 ¥1、Gemini 3.5 Flash-Lite 输入 $0.3,前者数字大,实际按 2026-08-09 的汇率折下来 反而是 DeepSeek 更便宜。想跨国比,点表头让它按折算后的值排序,或者直接去 月成本估算器选个结算币种算总账。

一、刊例价不等于你的实际单价。多数厂商都有缓存命中折扣(重复的前缀输入按低价计), Batch 批处理通常打五折,量大还能谈。反过来也有涨的:有的厂商公布了峰谷定价,高峰时段单价翻倍。 表里的数字是标准档,折扣和溢价写在备注列里。

二、区间价取的是下限。有些模型按 prompt 长度分档,比如输入价标成一个区间, 短提示走低档、长提示走高档。表里为了可排序取了下限,完整区间写在备注里—— 如果你的场景是长上下文,请按上限估。

三、输出价通常是输入价的几倍。只盯输入价选型会选错。 真实成本取决于你的输入输出比:做摘要(长输入短输出)和做生成(短输入长输出),最优解常常不是同一个模型。 把两个数一起代进月成本估算器再排序,比肉眼比价靠谱。

四、分词器差异会吃掉一部分价格优势。单价低但中文分词更碎的模型, 同样一段中文会切出更多 token,实际账单未必更省。可以先用 token 计算器估一下你的典型文本量级,心里有个底。

国产模型的价格为什么一行装不下

国产厂商的定价页普遍比海外复杂:同一个模型按输入长度分成好几档, 有的还区分「思考模式」和普通模式、区分单价与阶梯包、限时活动价和刊例价混排。 比如 qwen3.7-flash 就分三档,从 ¥0.2/¥0.8 一路到 ¥1.2/¥4.8,差六倍; GLM-5 跨过 32K 输入就从 ¥4/¥18 跳到 ¥6/¥22。

抄成一行数字必然失真,所以表里统一取最低档做可排序的锚点, 把完整分档规则原样写进备注列。你的场景如果是长上下文,请直接按备注里的高档估, 别拿表里那个最低价做预算。想看各家计费口径的逐条拆解,可以读 国产大模型 API 价格对比那篇。

常见问题

为什么表里有的价格标 $、有的标 ¥?

因为厂商官方就是这么标的。海外几家的定价页写的是美元,国内几家写的是人民币刊例价。我们坚持按官方原文的币种记录,不做折算后再存——一旦折算,你看到的就不再是厂商说过的数字,而是我们按某天汇率算出来的数字。想只看一侧时,用表格上方的「币种」筛选器切换即可。

既然不折算,怎么跨国比价?

点表头排序时,我们内部会按 1 美元 ≈ 6.7476 人民币(2026-08-09 取数)把两边折到同一基准来决定行的先后,但显示出来的永远是官方原价。要按你自己的用量算总账,去月成本估算器,那里可以选结算币种,页面会明写用的是哪个汇率。汇率天天在动,这类折算只用来判断量级,别当报价用。

为什么没有腾讯混元 / 百度文心?

因为核不到公开的官方现价。腾讯混元的公开文档页已公告原平台不再新增模型能力、停止支持新购模型服务,主力语言模型的定价迁到了需要登录的 TokenHub 控制台;我们不列需要登录才能看到、读者无法自行复核的价格。本表的硬规矩是:只收录能在厂商官方定价页上逐字查到的条目,核不到就空着,绝不用第三方转述价补位。

表里的价格能直接拿去做预算吗?

可以做量级判断,不能当合同价。分档计费(按上下文长度跳档)、缓存命中折扣、Batch 五折、Preview 阶段调价、峰谷定价,都会让实际账单偏离刊例价。做正式预算前请点开对应的官方来源链接现场确认。

选好模型之后,下一步是接进来

各家 API 的密钥申请、SDK 调用、报错排查,奇连 AI 按厂商写好了逐篇教程。

去学习中心