豆包 API 怎么收费?火山方舟 token 单价与省钱用法
数据截至 2026-08-09,价格与限额以各官网为准。本次更新用浏览器渲染了官方价格总表,拿到了此前抓不到的完整数据。
豆包 API 的计费单位和别家一样是”元/百万 tokens”,但计费逻辑不一样——多数模型不是一口价,而是按你这次请求的输入长度落进哪个区间,决定这次请求(含输出)用哪档单价。这一点不搞清楚,估算成本很容易算错。
上一版这篇文章有个明显的短板:火山方舟的价格总表页面是 JavaScript 动态渲染的,当时抓取拿到的是空壳,所以文里大半数字只能靠第三方转述交叉印证,还标了一堆”未核实”。这次换了方法——用浏览器把页面渲染出来再读,官方原文表格完整拿到了。所以这一版删掉了那些免责,下面的数字都是官方价格页上的原始数据。
计费单位:元/百万 tokens,但看的是”分段”不是”一口价”
火山方舟主力是 Doubao-Seed 系列。多数模型采用分段计费:系统看你这次请求的输入长度落在哪个区间,然后这次请求**全部的 token(包括输出)**都按这个区间对应的单价来算。
官方文档给的例子很直白:请求输入 200k tokens、输出 14k tokens,满足”输入长度 (128, 256]“这个条件,那么这次请求的输入按 2.4 元/百万、输出按 24 元/百万结算。注意是整次请求都按这一档,不是”前 128k 按低价、超出部分按高价”的累加算法。
这个设计对使用者最直接的影响是:同一个模型,你今天发一个短 prompt 和明天发一个长 prompt,单价可能不是同一档。做成本估算时不能只记”某模型多少钱一百万 token”,还得看这次调用的输入长度落在哪个区间。
主力模型单价表(官方原文数据)
单位元/百万 token,“条件”列的数字单位是千 token。缓存存储费全系统一 0.017 元/百万token/小时:
| 模型 | 条件(输入长度) | 输入 | 缓存命中 | 输出 |
|---|---|---|---|---|
doubao-seed-evolving | [0, 1024] | 6.00 | 1.20 | 30.00 |
doubao-seed-2.1-pro | [0, 256] | 6.00 | 1.20 | 30.00 |
doubao-seed-2.1-turbo | [0, 256] | 3.00 | 0.60 | 15.00 |
doubao-seed-2.0-pro | [0,32] / (32,128] / (128,256] | 3.2 / 4.8 / 9.6 | 0.64 / 0.96 / 1.92 | 16 / 24 / 48 |
doubao-seed-2.0-code | [0,32] / (32,128] / (128,256] | 3.2 / 4.8 / 9.6 | 0.64 / 0.96 / 1.92 | 16 / 24 / 48 |
doubao-seed-2.0-lite | [0,32] / (32,128] / (128,256] | 0.6 / 0.9 / 1.8 | 0.12 / 0.18 / 0.36 | 3.6 / 5.4 / 10.8 |
doubao-seed-2.0-mini | [0,32] / (32,128] / (128,256] | 0.2 / 0.4 / 0.8 | 0.04 / 0.08 / 0.16 | 2.0 / 4.0 / 8.0 |
doubao-seed-code | [0,32] / (32,128] / (128,256] | 1.20 / 1.40 / 2.80 | 0.24 | 8 / 12 / 16 |
doubao-seed-1.6-lite | [0,32] / (32,128] / (128,256] | 0.30 / 0.60 / 1.20 | 0.06 | 0.60 或 2.40 / 4.00 / 12.00 |
doubao-seed-1.6-flash | [0,32] / (32,128] / (128,256] | 0.15 / 0.30 / 0.60 | 0.03 | 1.50 / 3.00 / 6.00 |
doubao-1.5-pro-32k | 无分段 | 0.80 | 0.16 | 2.00 |
doubao-1.5-lite-32k | 无分段 | 0.30 | 0.06 | 0.60 |
几个读表要点:
**doubao-seed-2.1-turbo 正好是 pro 的一半。**上一版只能写”媒体报道说大致是一半,是约数,建议核实”,这次官方数据确认了:pro 是 6.00/1.20/30.00,turbo 是 3.00/0.60/15.00,三项全部精确对半。如果你的任务不需要 pro 那档能力,这是个很干净的降本选择。
**缓存命中价基本是标价的两成。**几乎每一行的命中价除以输入价都是 0.2 左右。doubao-seed-code 稍微特别一点:它的缓存命中价固定 0.24 元,不随输入长度跳档——也就是说输入落在最贵的 (128,256] 档时,标价 2.80 元而命中价仍是 0.24 元,折扣力度反而放大到不足一折。长上下文的编程场景,把缓存吃好收益特别明显。
输出长度也可能影响档位。doubao-seed-1.6-lite 和 doubao-seed-1.8 这类模型,在输入 [0,32] 这一档里还要再看输出:输出不超过 0.2K 时输出价 0.60 元,超过就跳到 2.40 元(1.6-lite)。分类、抽取这类短输出任务,卡住 max_tokens 能实打实省钱。
最便宜的档位便宜到什么程度:doubao-seed-2.0-mini 输入 0.2 元、doubao-seed-1.6-flash 输入 0.15 元、命中价 0.03 元。跑简单分类、意图识别这类活儿,成本基本可以忽略不计。
一个容易被忽略的事:方舟也在转售别家的模型
这次核实还发现一件上一版完全没提、但对选型很有价值的事——火山方舟不只卖豆包,也上架转售智谱和 DeepSeek 的模型,而且价格跟原厂比差异很大:
| 模型(在方舟上) | 输入 | 缓存命中 | 输出 | 原厂同款价格 |
|---|---|---|---|---|
deepseek-v4-pro | 12.00 | 1.00 | 24.00 | DeepSeek 官方:输入 3 元 / 输出 6 元 |
deepseek-v4-flash | 1.00 | 0.20 | 2.00 | DeepSeek 官方:输入 1 元 / 输出 2 元,命中 0.02 元 |
glm-5.2 | 8.00 | 2.00 | 28.00 | 智谱官方:输入 8 元 / 输出 28 元,命中 2 元 |
glm-4.7(三档) | 2.0 / 3.0 / 4.0 | 0.4 / 0.6 / 0.8 | 8 / 14 / 16 | 与智谱官方一致 |
结论挺有意思:GLM 在方舟上和智谱官方同价,DeepSeek 却贵得多。deepseek-v4-pro 在方舟是 12/24 元,原厂只要 3/6 元,差整整 4 倍;flash 档标价虽然一样,但缓存命中价从原厂的 0.02 元变成 0.20 元,差 10 倍——而缓存命中恰恰是 DeepSeek 最能省钱的地方。
这不是说方舟”坑人”,第三方平台转售要覆盖自己的成本,而且统一账单、统一控制台、统一鉴权本身就有价值。但如果你选方舟的理由是”上面能买到便宜的 DeepSeek”,那这个理由不成立;如果理由是”我本来就在用豆包,顺手把 DeepSeek 也放这儿省得多开一个账号”,那就要清楚这份省事的溢价是多少。
批量推理:五折,而且缓存照样能吃
如果你的任务能接受异步,走批量推理是最省事的降本手段。官方原文是”按 token 后付费,相比在线推理,价格低至 50%“,实际表里也确实是对半砍:doubao-seed-2.1-pro 从 6.00/30.00 变成 3.00/15.00,doubao-seed-2.1-turbo 从 3.00/15.00 变成 1.50/7.50。
值得注意的是,批量推理的表里仍然保留了缓存命中价这一列(比如 seed-2.1-pro 批量的命中价是 1.20 元),官方也写了”部分模型已支持透明前缀缓存能力,无需任何配置,享受命中缓存后的更低单价”。这跟有些平台”批量折扣和缓存折扣二选一”的规则不一样——在方舟这边,批量任务里的重复前缀依然能吃到缓存价,两种优惠不是互斥的。对于批量处理同一批参考文档这类场景,这个组合很划算。
Managed Agents 怎么计费
如果你用的是方舟的 Managed Agents(托管 Agent),计费是三项累加,跟单纯调模型不一样:
- 模型调用:按实际调用的模型单价走,参见上面的在线推理表;
- Agent 运行时(云端隔离沙箱,用于执行代码、读写文件、跑命令行):0.5 元/小时,只在 Session 状态为 running 时计费,idle、rescheduling、terminated 状态不计费;
- 工具调用:
web_search0.02 元/次,web_fetch限时免费。
另外官方写明首次开通赠送 30 小时 Agent 运行时 + 500 次 web_search,每个账号仅赠送一次,有效期 2 年。
这里最容易被低估的是运行时费用:0.5 元/小时看着不多,但如果你的 Agent 会话经常挂着不结束,一个月下来是笔固定开销,而且它和 token 用量无关——省 token 省不到它头上。好在 idle 状态不计费,这个设计还算合理,但前提是你的会话真的会进入 idle 而不是空转。
新用户免费额度
上一版写的是”新用户注册开通方舟后,豆包全系赠送 50 万 tokens 一次性免费额度”。这条本次没有在官方价格页上复核到,所以这里如实标注:它可能仍然有效、也可能已经调整,请以你注册时控制台实际显示的为准,别拿这个数字做预算依据。
同理,网上流传的”控制台开通管理页可加入协作奖励计划、每天再送 200 万 tokens”这条,本次依然没有从官方一手页面确认到,不当成既定规则来写。
本次能确认的免费资源只有前面说的 Managed Agents 那笔:30 小时运行时 + 500 次 web_search,一次性,有效期 2 年。
月成本怎么估算
公式的前提是先确认你这次调用的输入长度落在哪个分段:
单次成本 = 输入 token 数 / 1,000,000 × 该分段对应输入单价
+ 输出 token 数 / 1,000,000 × 该分段对应输出单价
月成本 ≈ 单次成本 × 每月请求数
举个例子,用 doubao-seed-code 估算一个每天 2,000 次的代码补全/问答场景,平均每次输入 10,000 token(落在 [0,32] 这一档)、输出 800 token:
- 单次输入成本:10,000 / 1,000,000 × 1.20 元 = 0.012 元
- 单次输出成本:800 / 1,000,000 × 8.00 元 = 0.0064 元
- 单次合计:约 0.0184 元
- 每天 2,000 次:约 36.8 元
- 一个月(30 天):约 1,104 元
再看看缓存能带来多大差别。假设这个场景里有 70% 的输入是固定的项目上下文、能稳定命中缓存(命中价 0.24 元):
- 命中部分输入:10,000 × 0.7 / 1,000,000 × 0.24 元 = 0.00168 元
- 未命中部分输入:10,000 × 0.3 / 1,000,000 × 1.20 元 = 0.0036 元
- 加上输出 0.0064 元,单次约 0.0117 元
- 一个月:约 702 元
同样的活儿,把缓存吃好省了三成六。如果再叠上批量推理的五折(前提是能接受异步),还能再往下压一大截。
豆包这边模型迭代和调价都比较频繁——从 Seed 1.6 到 1.8、2.0、2.1 Pro,再到现在的 Seed-Evolving,节奏很快。正式立项前建议直接打开控制台的价格计算器跑一次真实用量估算,比拿任何一篇文章里的数字外推都靠谱。
常见坑 / 注意
- 分段计费别当成固定单价:同一个模型,输入长度不同会落进不同价格区间,且整次请求(含输出)都按那一档结算,不是超出部分单独加价。
- 输出长度也会跳档:
doubao-seed-1.6-lite、doubao-seed-1.8在短输入档里还看输出长度,超过 0.2K 输出价跳几倍。短输出任务卡住max_tokens。 doubao-seed-code的缓存命中价不跳档:固定 0.24 元,输入越长折扣力度越大,长上下文编程场景优先做缓存优化。- 别为了买便宜 DeepSeek 而来方舟:
deepseek-v4-pro在方舟 12/24 元,原厂 3/6 元,差 4 倍;flash 的缓存命中价差 10 倍。GLM 倒是同价。 - 批量和缓存在方舟可以同时吃:跟某些平台”二选一”的规则不同,批量表里保留了缓存命中价。
- Managed Agents 的运行时费用与 token 无关:0.5 元/小时按 running 时长算,省 token 省不到它头上,注意会话别空转。
- 50 万 tokens 新人额度本次未复核:以控制台实际显示为准,别拿它做预算依据。
- “每日 200 万 tokens 协作奖励”仍未获官方确认:用前自己去控制台核实。
- 官方价格页是 JS 渲染:自己核实时记得用浏览器直接打开,简单抓取工具会拿到空壳。
接下来看什么
留言讨论
评论发布后会被人工复核,违规内容将被删除。
如果发表没有反应,可以前往联系我们告诉我们。