文心 ERNIE API 多少钱?千帆各模型 token 单价与成本

2026-07-07

数据截至 2026-07,价格与限额以各官网为准。

文心 ERNIE API 按 token 计费,千帆官方计费页给出的原始单位是”元/千 tokens”,跟大多数同类平台习惯用”元/百万 tokens”不太一样,换算的时候容易出错;更关键的是,千帆同时在架 ERNIE 5.1、5.0、4.5 三代模型,价差能拉开好几十倍,选错型号成本差距会很明显。

如果你只是想先估个大概,先记住一句话:千帆的文心模型不是”越新越贵”这么简单,旗舰 ERNIE 5.1/5.0 走的是按上下文长度分档计价,性价比款 ERNIE 4.5 Turbo 系列价格低出一大截,具体差多少、该怎么选,往下看。

计费单位:先把”千 tokens”换算清楚

千帆官方计费页给出的原始单位是元 / 千 tokens(人民币),本文为了方便跟同类文章的单价表对齐,统一换算成元 / 百万 tokens(乘以 1000)。换算方向不难,但正式做报价或者成本模型之前,建议自己回官方计费页核对一遍原始数字,别只信本文换算后的结果。

计费方式以”按量后付费”为主,部分模型还支持”按量包预付费""按 TPM(每分钟 token 数)付费”这类模式,具体怎么选看你的业务形态。另外官方页面上会不定期出现”2 月活动""3 月活动”这类限时批量推理折扣,这些是短期活动价,写成本模型的时候不要把活动价当长期价格拿来用。

单价表:ERNIE 5.1 / 5.0 旗舰系列

以下价格来自千帆官方计费页,已从元/千 tokens 换算为元/百万 tokens(人民币口径):

模型API 模型 ID上下文窗口输入价格输出价格说明
ERNIE 5.1(当前旗舰)ernie-5.1128K4~6 元18~22 元按上下文分档:≤32K 输入 4/输出 18,32K–128K 输入 6/输出 22
ERNIE 5.0ernie-5.0128K6~10 元24~40 元官方给的是区间,未见更细的按档拆分
ERNIE 5.0 Thinking Previewernie-5.0-thinking-preview128K未核实到独立拆分数字同左参考 ERNIE 5.0 区间,具体以官网为准
ERNIE 5.0 Thinking Latesternie-5.0-thinking-latest128K未核实未核实以官网为准

能看出 ERNIE 5.1 是目前官方在架的当前旗舰,价格反而比上一版 ERNIE 5.0 更低一些,这跟很多平台”越新越贵”的直觉不太一样,选型时不要单凭型号新旧下判断,实际以计费页当页数字为准。

单价表:ERNIE 4.5 系列(性价比主力)

模型API 模型 ID上下文窗口输入价格(在线)输出价格(在线)说明
ERNIE 4.5 Turbo 128Kernie-4.5-turbo-128k128K0.8 元3.2 元批量批处理价更低:输入 0.32/输出 1.28
ERNIE 4.5 Turbo 32Kernie-4.5-turbo-32k32K0.8 元3.2 元与 128K 版本在线价一致
ERNIE 4.5 Turbo VL(视觉多模态)ernie-4.5-turbo-vl / -vl-32k128K / 32K3 元9 元批量价:输入 1.2/输出 3.6
ERNIE 4.5 8Kernie-4.5-8k8K4 元16 元批量价:输入 1.6/输出 6.4;注意与开源版命名区分
ERNIE 4.5 开源 0.3B 稠密版ernie-4.5-0.3b128K0.1 元0.4 元官方在架模型中价格最低档位之一
ERNIE Speed Pro 128Kernie-speed-pro-128k128K0.3 元0.6 元轻量款
ERNIE Lite Pro 128Kernie-lite-pro-128k128K0.2 元0.4 元更轻量
ERNIE Character 8Kernie-char-8k8K未核实未核实角色扮演场景,具体单价以官网为准

另外还有一项缓存命中价格:ERNIE 4.5 Turbo 系列的缓存命中部分单价是 0.2 元/百万 tokens,比正常输入价便宜不少,如果你的应用有固定前缀(比如系统提示词很长且重复),这部分能省下明显的成本,但官方计费页对缓存命中的具体触发条件没有给出逐字说明,建议实际接入时通过响应里的用量字段核实是否命中。

把两张表放一起看能感觉出一个明显的价差:ernie-4.5-turbo-128k 输入 0.8 元、输出 3.2 元,跟旗舰 ernie-5.1 的 46 元、1822 元相比,价格差了 5 到 7 倍左右。如果你的任务是摘要、简单问答、内容分类这类对模型能力要求不算顶尖的场景,ernie-4.5-turbo-128k 这类性价比款基本够用;只有涉及复杂推理、长链路 Agent 编排这类真正需要旗舰能力的场景,才值得为 ERNIE 5.1/5.0 多付这份差价。

千帆平台还同时上架了 DeepSeek、Qwen、GLM、Kimi 等第三方模型,不是文心自研,本文不展开对比,如果要查那几家的单价,请去对应的独立事实来源核实,不要把文心和第三方模型的价格混着引用。

ERNIE 4.5 开源了,是不是就免费了?

这里有个经常被搞混的地方,值得单独说清楚:百度在 2025 年年中正式开源了文心大模型 4.5 系列,一次性放出了 10 款模型,参数规模从 0.3B 稠密版覆盖到数千亿参数级别的 MoE 结构,采用 Apache 2.0 协议,允许学术研究和商业使用,权重可以在飞桨星河社区、HuggingFace 等平台下载。

开源权重自己部署,跟千帆平台上按 token 付费调用 API 是两件不同的事。即便模型本身是开源免费的,只要你走的是千帆 API 这条通道,依然要按上面表格里的单价计费——除非你自己拿开源权重去本地或者其他云上部署推理服务,那才是真正意义上”免费”(当然算力成本自己承担)。别把”模型开源”和”API 免费”划等号,这是本文提醒的第一个容易搞混的地方。

免费额度:暂无官方明确数字

千帆这次核实没有找到官方计费页明确列出的”新用户赠送多少 token”这类通用免费额度条款,第三方资讯口径也不统一,所以本文不给具体数字,也不建议你按网上搜到的旧数字来做预算——千帆是否有新用户免费额度、具体数额多少,请以你登录后的控制台账户页面实时展示为准

如果你想找一个低成本的练手选项,ernie-4.5-0.3b 这档 0.1/0.4 元每百万 tokens 的开源模型,是官方在架模型里价格最低的档位之一,虽然不是完全免费,但用来验证接入链路、跑小流量测试基本可以忽略成本。另外要提醒一句,百度历史上有过”文心一言官网/App 端对个人用户免费开放”的说法,那说的是面向消费者的对话产品,跟千帆 API 的按量计费是两个不同的产品体系,别把这两者搞混。

月成本怎么估算

给一个能直接套用的公式:

单次成本 = 输入 token 数 / 1,000,000 × 输入单价
         + 输出 token 数 / 1,000,000 × 输出单价
月成本 ≈ 单次成本 × 每月请求数

举个例子,用 ernie-4.5-turbo-128k(输入 0.8 元、输出 3.2 元每百万 tokens)估算一个每天 5,000 次调用的客服问答功能,平均每次输入 800 token、输出 200 token:

  • 单次输入成本:800 / 1,000,000 × 0.8 元 ≈ 0.00064 元
  • 单次输出成本:200 / 1,000,000 × 3.2 元 = 0.00064 元
  • 单次合计:约 0.00128 元
  • 每天 5,000 次:约 6.4 元
  • 一个月(30 天):约 192 元

如果换成旗舰款 ernie-5.1(按较低档位输入 4 元、输出 18 元估算),同样的用量规模,成本会直接拉高到原来的 5 倍左右,一个月大概是近千元的量级——这也是为什么选型不能只看”模型能力强不强”,还要看这个任务是不是真的用得上旗舰款的能力,很多常规文本处理任务用性价比款完全够。如果你的应用调用量会随业务增长明显上升,建议先用小流量跑一段时间拿到真实的平均 token 数,再代入公式重新估算,别只按一次估算的数字长期不变地做预算。

常见坑 / 注意

  • 单位换算别搞错:官方原始单位是元/千 tokens,本文表格已换算成元/百万 tokens,正式报价前建议自己回官方计费页核对一遍原始数字。
  • “模型开源”不等于”API 免费”:ERNIE 4.5 系列开源权重可自行部署免费用,但走千帆 API 调用依然按上表价格计费。
  • 别只看型号新旧判断贵贱:ERNIE 5.1 作为当前旗舰,价格反而比上一版 ERNIE 5.0 更低,具体以计费页当页数字为准,不要凭直觉猜。
  • 限时活动价不能当长期价格用:官方页面偶尔出现的批量推理折扣是短期活动,写成本模型时别把活动价当常态。
  • 免费额度暂无官方明确数字:网上流传的具体数额可能是旧信息,请以控制台账户页面实时展示为准。
  • 别把文心和第三方模型的价格混着引用:千帆平台同时上架 DeepSeek、Qwen 等第三方模型,价格体系各自独立,本文只讲文心自研的 ERNIE 系列。

接下来看什么

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。