豆包 API 怎么收费?火山方舟 token 单价与省钱用法

2026-07-07

数据截至 2026-07,价格与限额以各官网为准。

豆包 API 的计费单位和别家一样是”元/百万 tokens”,但计费逻辑不一样——多数模型不是一口价,而是按你这次请求的输入长度落进哪个区间,决定这次请求(含输出)用哪档单价,这一点不搞清楚,估算成本很容易算错。

如果你是从 Claude、DeepSeek 这类”固定单价”的平台转过来看豆包定价页,第一反应很可能是”这表怎么这么多档”。这篇把计费单位、分段规则、目前拿到的具体单价、免费额度和成本估算方法过一遍,该标”未核实”的地方也如实标出来,不瞎编数字。

计费单位:元/百万 tokens,但看的是”分段”不是”一口价”

火山方舟主力是 Doubao-Seed 系列(原来的 Doubao-1.5 系列还在售,但主推已经是 Seed 系列)。多数模型采用分段计费:系统会看你这次请求的输入长度落在哪个区间,然后这次请求全部的 token(包括输出)都按这个区间对应的单价来算,而不是像很多平台那样”输入一个价、输出一个价,跟长度没关系”。

这个设计对使用者最直接的影响是:同一个模型,你今天发一个短 prompt 和明天发一个长 prompt,单价可能不是同一档。做成本估算的时候,不能只记”某模型多少钱一百万 token”,还得留意这次调用的输入长度落在哪个区间。

几个主力模型看到的单价(能核实的先说)

先说清楚一个前提:火山方舟官方的”模型价格”总表页面是 JavaScript 动态渲染的,直接抓取拿到的是空壳,本文的具体数字来自对官方页面的第三方检索摘要与多方转述交叉验证,不是逐字抓取的官方原文表格。凡是下面标”未核实”的地方,请以官网 volcengine.com/docs/82379/1544106 这个价格总表页面当次打开为准,别拿本文的数字直接去做正式报价单。

Doubao-Seed-1.6 系列(256K 上下文,当前主力通用模型,有 thinking / non-thinking / 自适应思考三种模式,还分出 thinking、flash、vision、lite 几个子版本):这是分段计费的典型代表,抽样看到的档位是——输入 200K、输出 14K 落进 (128K, 256K] 这一档时,输入 2.4 元/百万 token、输出 24 元/百万 token;输入 16K 这一档,其中 vision 版是输入 0.8 元/百万、输出 8 元/百万,性价比更高的 lite 版是输入 0.3 元/百万、输出 2.4 元/百万。完整的分段区间对照表(各输入区间对应单价的全表)未能核实到官方原文,本文只有这几个抽样档位,具体请以官网价格页实时表格为准。

Doubao-Seed-Code(编程模型,专门给写代码场景用的):这个模型的分段区间和单价核实得比较完整,因为是分层结构清楚的一张表:0–32K 输入区间是输入 1.20 元/百万、输出 8.00 元/百万;32K–128K 输入区间是输入 1.40 元/百万、输出 12.00 元/百万;128K–256K 输入区间是输入 2.80 元/百万、输出 16.00 元/百万。还有一个特殊优惠档:输入不超过 32K 且输出不超过 200 tokens 时,输出价会降到 2 元/百万;深度思考模式和多模态输入都不额外加价。

Doubao-Seed-2.1 Pro(2026-06-23 发布的当前旗舰,主打 Coding / Agent / 多模态方向):价格是输入 6 元/百万 token、输出 30 元/百万 token,缓存命中价 1.2 元/百万 token——这三个数字来自多家媒体报道交叉印证,可信度较高。它还有个轻量版 Doubao-Seed-2.1 Turbo,报道说大致是 2.1 Pro 价格的一半,但没看到官方精确数字,这个”一半”是约数,正式引用前建议核实

Doubao-Seed-1.8(2026 年新版,多模态和 Agent 能力增强):同样按输入长度分段,抽样看到输入 16K 时是输入 0.8 元/百万、输出 8 元/百万;另外还有一个细分的极小输入档(输入在 [0, 32K] 区间内、输出在 [0, 0.2K] 这么小的范围时,输出价 2 元/百万,超出这个输出范围就跳到 8 元/百万),但这条只有第三方转述、没见到官方原文截图,建议核实后再用。

老版本 Doubao-1.5 系列(比如 doubao-1.5-pro-32k)还在售,供对比参考,但具体单价这次没能稳定核实到,如果你手头还有老项目在用这个版本,建议直接上控制台看当前实际计费。

缓存命中怎么算:能省钱,但具体折扣没能核实到统一比例

火山方舟支持上下文缓存,命中缓存的部分单价明显低于未命中——这一点在 Doubao-Seed-2.1 Pro 上看得最清楚:正常输入价 6 元/百万,缓存命中价 1.2 元/百万,命中价大约是正常价的两成。其他模型是否有类似比例的缓存折扣、具体命中价是多少,本次核实没有拿到覆盖全系列的统一数字,这部分请以你实际调用的那个模型在官网价格页上标注的缓存价为准,不要直接套用 2.1 Pro 这一个模型的折扣比例去套算别的模型,档位不一样,折扣幅度大概率也不一样。

如果你的场景里有固定不变的系统提示词、长文档、或者反复处理同一批参考资料,把这些放在 prompt 前面让它更容易被缓存命中,理论上是划算的做法——但具体划算多少,还是那句话,拿你实际用的模型去核实缓存单价再算账,别凭印象估。

新用户免费额度:50 万 tokens

这条核实得比较扎实:新用户注册火山引擎、开通方舟之后,豆包全系模型(包括方舟平台上架的其他厂商模型,比如 DeepSeek 系列)共赠送 50 万 tokens 的一次性免费推理额度,0 成本先试跑。

这份额度只能抵扣按 token 计费的在线推理费用,不能抵扣插件调用、知识库调用的费用,也不能抵扣批量推理(Batch)产生的消耗;但可以抵扣上下文缓存命中与未命中部分的 token 费用、以及输出 token 费用,抵不了的只有缓存本身的存储费用这一小项。部分基础模型(豆包 pro/lite 的 4K、32K 版本)还额外给了 1 万 RPM、80 万 TPM 的免费流量额度,这是给这类入门规格单独准备的,跟 50 万 tokens 那笔一次性额度是两回事,别混着算。

至于网上有说法提到控制台”开通管理”页可以加入”协作奖励计划”、每天再送 200 万 tokens——这条只是第三方汇总信息,没有从官方一手页面确认到,本文不当成既定规则来写,感兴趣的话去控制台那个页面自己核实一遍最稳妥。

月成本怎么估算

给一个能直接套的公式,前提是先确认好你这次调用的输入长度落在哪个分段区间、对应哪档单价:

单次成本 = 输入 token 数 / 1,000,000 × 该分段对应输入单价
         + 输出 token 数 / 1,000,000 × 该分段对应输出单价
月成本 ≈ 单次成本 × 每月请求数

举个例子,用 Doubao-Seed-Code 编程模型估算一个每天 2,000 次的代码补全/问答场景,平均每次输入 10,000 token(落在 0–32K 这一档)、输出 800 token:

  • 单次输入成本:10,000 / 1,000,000 × 1.20 元 = 0.012 元
  • 单次输出成本:800 / 1,000,000 × 8.00 元 = 0.0064 元
  • 单次合计:约 0.0184 元
  • 每天 2,000 次:约 36.8 元
  • 一个月(30 天):约 1,104 元

这只是按你实际用量代入公式的一个演示,真实成本取决于你的输入长度到底落在哪个分段、有没有吃到缓存折扣、用的是哪个具体模型——豆包这边模型迭代和调价都比较频繁(从 Seed 1.6 到 1.8 再到 2.1 Pro,一年内就经历了三次大版本更新),正式立项前,建议直接打开控制台的实时计费预估工具 console.volcengine.com/ark 跑一次真实用量估算,比拿任何一篇文章里的数字外推都靠谱。

常见坑 / 注意

  • 分段计费别当成固定单价:同一个模型,输入长度不同可能落进不同价格区间,估算成本前先确认自己的输入落在哪一档。
  • 完整分段区间表未核实齐全:本文只有抽样档位,正式报价前去官网价格总表页面当次核实完整表格。
  • 缓存折扣比例因模型而异:别拿 2.1 Pro 的折扣比例去套算其他模型,各自以官网为准。
  • 免费额度抵不了 Batch 和插件调用:50 万 tokens 只抵在线推理,别的调用类型不算在内。
  • 旧版本模型价格未稳定核实:老项目还在用 Doubao-1.5 系列的,直接上控制台看当前实际计费更准。
  • 别把传闻当规则:“每日 200 万 tokens 协作奖励”这类没有官方一手确认的说法,用前先去控制台核实。
  • 官方价格页是 JS 渲染:如果你也想自己核实,记得用浏览器直接打开页面看,别用简单抓取工具,会拿到空壳。

接下来看什么

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。