Grok API 怎么收费?xAI 各模型 token 单价与成本估算
数据截至 2026-07,价格与限额以各官网为准。
Grok API 按 token 计费,输入输出分开定价,旗舰档 grok-4.3 每百万 token 输入 $1.25、输出 $2.50;真正容易踩坑的地方不是算错公式,而是网上大量第三方”价格指南”引用的还是旧版模型的数字,官方当前页面早已不这么标了,报价前务必自己去核对一遍。
xAI 今年内把定价页调整过不止一次,加上第三方 SEO 聚合站数据更新滞后,网上搜出来的价格表经常是几个月前的旧版本。这篇只引用官方文档当前页面实际抓取到的表格,凡是官方页面没有明确列出的旧模型数字,都会诚实标注”未核实”,不会替你把网上传的数字直接搬过来当成结论。
计费单位是什么
跟大多数大模型 API 一样,Grok 按 token 计费,单位是”每百万 token”(per million tokens),输入和输出分开计价,输出通常比输入贵一倍左右。这里的 token 不是按字数或字符数简单换算的,中文文本切出来的 token 数跟同样字数的英文不完全一样,实际账单要看 API 返回的 usage 字段里输入、输出各自消耗的 token 数,不能拿字数直接估算。
xAI 的产品线不只有对话模型,还有专门面向 IDE agent / 代码生成场景的代码模型,以及图像、视频、语音这些非文本模态,后面几种模态定价结构完全不同(按张、按秒计费),跟对话模型的”每百万 token”不是一回事,本文只讲对话和代码这两类按 token 计费的模型。
各模型单价表(官方当前页面实抓)
先看对话 / 推理模型(Chat API),这是大多数人接入 Grok 时用到的主力:
| 模型 id | 上下文窗口 | 输入价格(每百万 token) | 输出价格(每百万 token) |
|---|---|---|---|
grok-4.3(当前旗舰,别名 grok-4.3-latest / grok-latest) | 1M tokens | $1.25 | $2.50 |
grok-4.20-0309-reasoning | 1M tokens | $1.25 | $2.50 |
grok-4.20-0309-non-reasoning | 1M tokens | $1.25 | $2.50 |
grok-4.20-multi-agent-0309(多智能体协作场景) | 1M tokens | $1.25 | $2.50 |
看这张表会发现一个挺清楚的现象:官方当前页面列出来的这几个主力模型,输入输出单价是统一的,都是 $1.25 / $2.50,差异体现在推理模式(reasoning / non-reasoning)和多智能体协作这些能力形态上,不体现在价格上。也就是说选哪个模型主要看你的任务需不需要显式推理链路或者多智能体协作,不用纠结”哪个更便宜”,价格是一样的。
再看代码模型(Code API):
| 模型 id | 上下文窗口 | 输入价格 | 输出价格 |
|---|---|---|---|
grok-build-0.1(面向 IDE agent / 代码生成,专用 xai-sdk 调用) | 256K tokens | $1.00 | $2.00 |
这个专用代码模型比通用旗舰略便宜一档,上下文窗口也小一些(256K vs 1M),如果你的场景就是代码生成、IDE 内嵌 agent 这类任务,用这个专用模型比硬套通用旗舰更划算,但要注意它走的是 xai-sdk 原生调用方式,不是标准 chat 接口,接入方式和上面的通用对话模型不完全一样。
图像生成(grok-imagine-image-*)按张计费、视频生成(grok-imagine-video-*)按秒计费、语音相关模型按秒或按分钟计费,这几类价格结构跟”每百万 token”完全不是一回事,这篇不展开讲,只在这里提醒一句:不要把对话模型的单价套到这几个模态上去估算成本。
关于旧模型价格:这篇不引用具体数字
如果你之前查过 Grok 的资料,可能对 grok-4、grok-4-fast、grok-4.1-fast、grok-code-fast-1 这几个名字有印象。官方当前模型页面(2026-07 抓取)只展示 grok-4.3 与 grok-4.20 系列为主力,没有在页面上明确列出这几个旧模型的价格条目。文档里有一句提示是”多数用户应使用别名化模型名以自动获得最新版本”,这暗示旧版本可能已经收敛或者被别名指向了新模型,不是简单地”下线”了。
网上确实能搜到第三方资料给出过旧版 grok-4(256K 上下文)曾定价 $3.00/$15.00(输入/输出)、grok-4-fast 和 grok-4.1-fast(2M 上下文)曾为 $0.20/$0.50 这样的数字,但这些数字没有在官方当前页面直接核实到,本文不采信、不引用具体数值,如实标注为”未核实,以官网 docs.x.ai/developers/models 当前页面为准”。如果你手头的项目还在用这几个旧模型名调用,建议直接去当次官方页面确认价格和是否还能正常调用,不要照抄网上的旧数字去做报价单或者成本预算。这里能给出的确定性结论只有一句:入门 / 极速档模型的价格明显低于旗舰档,具体低多少以官网当次页面为准。
月成本怎么估算
给一个能直接套的公式:
单次成本 = 输入 token 数 / 1,000,000 × 输入单价
+ 输出 token 数 / 1,000,000 × 输出单价
月成本 ≈ 单次成本 × 每月请求数
举个例子,用 grok-4.3 估算一个每天 5,000 次请求的问答功能,平均每次输入 2,000 token、输出 500 token:
- 单次输入成本:2,000 / 1,000,000 × $1.25 = $0.0025
- 单次输出成本:500 / 1,000,000 × $2.50 = $0.00125
- 单次合计:约 $0.00375
- 每天 5,000 次:约 $18.75
- 一个月(30 天):约 $562.5
这只是按平均值估的粗算,实际业务里输入长度经常波动很大(比如带了长文档做上下文),真正上生产前建议先跑一批真实请求,从 usage 字段里拿到实际的输入输出 token 分布,再代入这个公式算一遍,比拍脑袋估的数字靠谱得多。
如果你的场景对成本敏感、又不需要旗舰档的推理能力,把上面例子里的模型换成 grok-build-0.1(如果任务性质匹配代码生成场景)能省下 20% 左右的单价成本;但这个模型上下文窗口只有 256K,长上下文场景不适用,选型时先看任务需要什么能力,价格是第二位的考量。
省钱怎么省
- 别用错模型:
grok-4.3系列几个变体价格相同,选哪个看任务是否需要显式推理或多智能体协作,不是价格决策;代码类任务如果能用grok-build-0.1,单价更低。 - 控制上下文长度:输入 token 越多花得越多,长文档场景先想清楚是不是真的需要整段塞进去,还是可以先做检索 / 摘要再喂给模型。
- 区分模态计费:图像、视频、语音是按张 / 按秒计费,不要拿文本模型的”每百万 token”单价去套算这些场景的成本。
- 报价前必核对官网:xAI 定价年内调整过多次,第三方聚合站的数据滞后风险很高,正式做成本预算或对外报价前,直接去
docs.x.ai/developers/models当次页面确认一遍。
常见坑 / 注意
- 旗舰档几个变体同价:
grok-4.3/grok-4.20-reasoning/non-reasoning/multi-agent单价都是 $1.25/$2.50,别以为选了某个变体会更贵或更便宜。 - 旧模型价格别照搬网上数字:
grok-4/grok-4-fast这些旧名字官方当前页面没有明确列出价格,网传数字未核实,写报价单前先去官网确认。 - 代码模型走独立接口:
grok-build-0.1用xai-sdk调用,不是标准 chat 接口,接入方式和通用对话模型不一样。 - 非文本模态别混算:图像、视频、语音按张 / 按秒计费,跟对话模型的 token 单价不是一套体系。
- token 数不能按字数估:中文和英文的 token 切分比例不同,实际账单以
usage字段里的真实数字为准。