大模型 API 价格对比表
每百万 token 的输入/输出单价。当前收录 23 个模型、9 家厂商(海外 4 家 + 国内 5 家),每行按官方原文币种标注,可点开官方定价页核对。
| 模型 | 厂商 | 输入价(每百万 token) ↕ | 输出价(每百万 token) ↕ | 上下文 | 多模态 | 备注 | 来源 / 核对日 |
|---|---|---|---|---|---|---|---|
| gpt-5.6-sol | OpenAI | $5 | $30 | 以官方文档为准 | — | 短上下文档价;长上下文档为 $10/$45,表内取下限。缓存命中输入 $0.50、缓存写入 $6.25;Batch/Flex 档另有价 | OpenAI 官方2026-08-09 |
| gpt-5.6-terra | OpenAI | $2 | $12 | 以官方文档为准 | — | 短上下文档价;长上下文档为 $4/$18,表内取下限。缓存命中输入 $0.20 | OpenAI 官方2026-08-09 |
| gpt-5.6-luna | OpenAI | $0.2 | $1.2 | 以官方文档为准 | — | 短上下文档价;长上下文档为 $0.40/$1.80,表内取下限。缓存命中输入 $0.02;该系列最便宜档 | OpenAI 官方2026-08-09 |
| Claude Opus 5 | Anthropic | $5 | $25 | 以官方文档为准 | — | 缓存命中 $0.50;5 分钟缓存写入 $6.25、1 小时 $10 | Anthropic 官方2026-08-09 |
| Claude Sonnet 5 | Anthropic | $2 | $10 | 以官方文档为准 | — | 官方标注为限时引导价,2026-08-31 前有效;2026-09-01 起恢复标准价 $3/$15。缓存命中 $0.20 | Anthropic 官方2026-08-09 |
| Claude Haiku 4.5 | Anthropic | $1 | $5 | 以官方文档为准 | — | 缓存命中 $0.10;该系列最便宜档 | Anthropic 官方2026-08-09 |
| Gemini 3.6 Flash | $1.5 | $7.5 | 以官方文档为准 | 是 | 付费层级价;Batch API 五折($0.75/$3.75);上下文缓存存储 $1.00/百万 token/小时 | Google 官方2026-08-09 | |
| Gemini 3.1 Pro(Preview) | $2 | $12 | 以官方文档为准 | 是 | 按 prompt 长度分档:≤20 万 token 为 $2/$12,>20 万 token 为 $4/$18,表内取下限;Batch 五折;Preview 阶段价格可能调整 | Google 官方2026-08-09 | |
| Gemini 3.5 Flash-Lite | $0.3 | $2.5 | 以官方文档为准 | 是 | 官方标为最具成本效益的正式版档;Batch 五折($0.15/$1.25) | Google 官方2026-08-09 | |
| grok-4.5 | xAI | $2 | $6 | 500K | — | 官方当前主推的唯一旗舰文本模型(语音、图像视频为独立 API 另计费) | xAI 官方2026-08-09 |
| deepseek-v4-flash | DeepSeek | ¥1 | ¥2 | 1M | — | 缓存命中输入 ¥0.02。官方已公告近期将整体上调 API 定价、预计涨幅较大,做长期预算前务必复核 | DeepSeek 官方2026-08-09 |
| deepseek-v4-pro | DeepSeek | ¥3 | ¥6 | 1M | — | 缓 存命中输入 ¥0.025。官方涨价公告同上 | DeepSeek 官方2026-08-09 |
| GLM-5.2 | 智谱AI | ¥8 | ¥28 | 1M | — | 缓存命中 ¥2;缓存存储官方标注限时免费 | 智谱开放平台2026-08-09 |
| GLM-5 | 智谱AI | ¥4 | ¥18 | 以官方文档为准 | — | 按输入长度分档:<32K 为 ¥4/¥18,≥32K 为 ¥6/¥22,表内取下限;缓存命中 ¥1 | 智谱开放平台2026-08-09 |
| GLM-4.7-FlashX | 智谱AI | ¥0.5 | ¥3 | 200K | — | 缓存命中 ¥0.1;同系列 GLM-4.7-Flash 官方标注为免费 | 智谱开放平台2026-08-09 |
| kimi-k3 | 月之暗面 | ¥20 | ¥100 | 1M(1,048,576 tokens) | — | 缓存命中输入 ¥2,与未命中价差 10 倍,长会话务必开自动上下文缓存 | Kimi 开放平台2026-08-09 |
| kimi-k2.7-code | 月之暗面 | ¥6.5 | ¥27 | 256K(262,144 tokens) | 是 | 缓存命中输入 ¥1.3;官方标注 支持文本、图片与视频输入;高速版 kimi-k2.7-code-highspeed 为 ¥13/¥54 | Kimi 开放平台2026-08-09 |
| qwen3.8-max | 阿里云 | ¥12 | ¥36 | 1M | — | 0–1M token 单一档、不分段;Batch 调用半价,上下文缓存另有折扣(两者不能同时生效) | 阿里云百炼2026-08-09 |
| qwen3.7-plus | 阿里云 | ¥2 | ¥8 | 1M | — | 按输入长度分档:≤256K 为 ¥2/¥8,256K–1M 为 ¥6/¥24,表内取下限;官方另标注限时 8 折;Batch 半价 | 阿里云百炼2026-08-09 |
| qwen3.7-flash | 阿里云 | ¥0.2 | ¥0.8 | 1M | — | 按输入长度分档:≤32K 为 ¥0.2/¥0.8,32K–256K 为 ¥0.6/¥2.4,256K–1M 为 ¥1.2/¥4.8,表内取下限;Batch 半价 | 阿里云百炼2026-08-09 |
| doubao-seed-2.1-pro | 字节跳动 | ¥6 | ¥30 | 以官方文档为准 | — | 输入长度 ≤256K 档价;缓存命中 ¥1.2,缓存存储 ¥0.017/百万 token/小时 | 火山方舟2026-08-09 |
| doubao-seed-2.1-turbo | 字节跳动 | ¥3 | ¥15 | 以官方文档为准 | — | 输入长度 ≤256K 档价;缓存命中 ¥0.6 | 火山方舟2026-08-09 |
| doubao-seed-2.0-mini | 字节跳动 | ¥0.2 | ¥2 | 以官方文档为准 | — | 按输入长度分档:≤32K 为 ¥0.2/¥2,32K–128K 为 ¥0.4/¥4,128K–256K 为 ¥0.8/¥8,表内取下限;音频输入另计价(¥3 起) | 火山方舟2026-08-09 |
最近一次逐条核对官方定价页:2026-08-09。表内 $ 为海外厂商官方美元价、¥ 为国内厂商人民币刊例价,均为官方原文,未做任何折算; 点表头排序时按 1 美元 ≈ 6.7476 人民币(2026-08-09 取数)折算比较,仅影响行序。价格随时可能调整,做预算前请点开来源链接现场确认。
这张表的每个数字都能点开验
搜「大模型 API 价格对比」能翻出几十张表,行数一张比一张多,但很少有哪张告诉你数字是从哪来的、什么时候核的。 结果就是:你照着表做完预算,一调用发现价格早改了,或者那个型号根本已经下线。
所以这张表定了一条硬规矩:只收录能在厂商官方定价页上逐字查到的条目, 每一行必须带官方链接和核对日期,核不到官方原文的厂商宁可空着。 现在收录了 9 家——海外 4 家(OpenAI、Anthropic、Google、xAI), 国内 5 家(DeepSeek、智谱、月之暗面、阿里云百炼、火山方舟), 每家取 1–3 个当前在售的主力档,不堆型号数凑长度。
没收录的也说清楚原因。腾讯混元的公开文档页已经公告原平台不再新增模型能力、停止支持新购模型服务, 主力语言模型的定价迁到了需要登录的 TokenHub 控制台。读者自己打不开去复核的价格,我们就不往表里放。 等它有了公开可查的定价页,再补进来。
读这张表要注意的五件事
零、别拿 $ 和 ¥ 直接比大小。表里海外几家标美元、国内几家标人民币,都是各自官方定价页上的原文。 看着 DeepSeek 输入 ¥1、Gemini 3.5 Flash-Lite 输入 $0.3,前者数字大,实际按 2026-08-09 的汇率折下来 反而是 DeepSeek 更便宜。想跨国比,点表头让它按折算后的值排序,或者直接去 月成本估算器选个结算币种算总账。
一、刊例价不等于你的实际单价。多数厂商都有缓存命中折扣(重复的前缀输入按低价计), Batch 批处理通常打五折,量大还能谈。反过来也有涨的:有的厂商公布了峰谷定价,高峰时段单价翻倍。 表里的数字是标准档,折扣和溢价写在备注列里。
二、区间价取的是下限。有些模型按 prompt 长度分档,比如输入价标成一个区间, 短提示走低档、长提示走高档。表里为了可排序取了下限,完整区间写在备注里—— 如果你的场景是长上下文,请按上限估。
三、输出价通常是输入价的几倍。只盯输入价选型会选错。 真实成本取决于你的输入输出比:做摘要(长输入短输出)和做生成(短输入长输出),最优解常常不是同一个模型。 把两个数一起代进月成本估算器再排序,比肉眼比价靠谱。
四、分词器差异会吃掉一部分价格优势。单价低但中文分词更碎的模型, 同样一段中文会切出更多 token,实际账单未必更省。可以先用 token 计算器估一下你的典型文本量级,心里有个底。
国产模型的价格为什么一行装不下
国产厂商的定价页普遍比海外复杂:同一个模型按输入长度分成好几档, 有的还区分「思考模式」和普通模式、区分单价与阶梯包、限时活动价和刊例价混排。 比如 qwen3.7-flash 就分三档,从 ¥0.2/¥0.8 一路到 ¥1.2/¥4.8,差六倍; GLM-5 跨过 32K 输入就从 ¥4/¥18 跳到 ¥6/¥22。
抄成一行数字必然失真,所以表里统一取最低档做可排序的锚点, 把完整分档规则原样写进备注列。你的场景如果是长上下文,请直接按备注里的高档估, 别拿表里那个最低价做预算。想看各家计费口径的逐条拆解,可以读 国产大模型 API 价格对比那篇。
常见问题
为什么表里有的价格标 $、有的标 ¥?
因为厂商官方就是这么标的。海外几家的定价页写的是美元,国内几家写的是人民币刊例价。我们坚持按官方原文的币种记录,不做折算后再存——一旦折算,你看到的就不再是厂商说过的数字,而是我们按某天汇率算出来的数字。想只看一侧时,用表格上方的「币种」筛选器切换即可。
既然不折算,怎么跨国比价?
点表头排序时,我们内部会按 1 美元 ≈ 6.7476 人民币(2026-08-09 取数)把两边折到同一基准来决定行的先后,但显示出来的永远是官方原价。要按你自己的用量算总账,去月成本估算器,那里可以选结算币种,页面会明写用的是哪个汇率。汇率天天在动,这类折算只用来判断量级,别当报价用。
为什么没有腾讯混元 / 百度文心?
因为核不到公开的官方现价。腾讯混元的公开文档页已公告原平台不再新增模型能力、停止支持新购模型服务,主力语言模型的定价迁到了需要登录的 TokenHub 控制台;我们不列需要登录才能看到、读者无法自行复核的价格。本表的硬规矩是:只收录能在厂商官方定价页上逐字查到的条目,核不到就空着,绝不用第三方转述价补位。
表里的价格能直接拿去做预算吗?
可以做量级判断,不能当合同价。分档计费(按上下文长度跳档)、缓存命中折扣、Batch 五折、Preview 阶段调价、峰谷定价,都会让实际账单偏离刊例价。做正式预算前请点开对应的官方来源链接现场确认。
选好模型之后,下一步是接进来
各家 API 的密钥申请、SDK 调用、报错排查,奇连 AI 按厂商写好了逐篇教程。