豆包 API 怎么收费?火山方舟 token 单价与省钱用法

2026-07-07 · 更新于 2026-08-09
站内工具 大模型 API 价格对比表 → 豆包 / GLM / Kimi / 千问 / DeepSeek 等 9 家厂商单价并排看,可按币种筛选、按价格排序,每行链到官方定价页。

数据截至 2026-08-09,价格与限额以各官网为准。本次更新用浏览器渲染了官方价格总表,拿到了此前抓不到的完整数据。

豆包 API 的计费单位和别家一样是”元/百万 tokens”,但计费逻辑不一样——多数模型不是一口价,而是按你这次请求的输入长度落进哪个区间,决定这次请求(含输出)用哪档单价。这一点不搞清楚,估算成本很容易算错。

上一版这篇文章有个明显的短板:火山方舟的价格总表页面是 JavaScript 动态渲染的,当时抓取拿到的是空壳,所以文里大半数字只能靠第三方转述交叉印证,还标了一堆”未核实”。这次换了方法——用浏览器把页面渲染出来再读,官方原文表格完整拿到了。所以这一版删掉了那些免责,下面的数字都是官方价格页上的原始数据。

计费单位:元/百万 tokens,但看的是”分段”不是”一口价”

火山方舟主力是 Doubao-Seed 系列。多数模型采用分段计费:系统看你这次请求的输入长度落在哪个区间,然后这次请求**全部的 token(包括输出)**都按这个区间对应的单价来算。

官方文档给的例子很直白:请求输入 200k tokens、输出 14k tokens,满足”输入长度 (128, 256]“这个条件,那么这次请求的输入按 2.4 元/百万、输出按 24 元/百万结算。注意是整次请求都按这一档,不是”前 128k 按低价、超出部分按高价”的累加算法。

这个设计对使用者最直接的影响是:同一个模型,你今天发一个短 prompt 和明天发一个长 prompt,单价可能不是同一档。做成本估算时不能只记”某模型多少钱一百万 token”,还得看这次调用的输入长度落在哪个区间。

主力模型单价表(官方原文数据)

单位元/百万 token,“条件”列的数字单位是千 token。缓存存储费全系统一 0.017 元/百万token/小时

模型条件(输入长度)输入缓存命中输出
doubao-seed-evolving[0, 1024]6.001.2030.00
doubao-seed-2.1-pro[0, 256]6.001.2030.00
doubao-seed-2.1-turbo[0, 256]3.000.6015.00
doubao-seed-2.0-pro[0,32] / (32,128] / (128,256]3.2 / 4.8 / 9.60.64 / 0.96 / 1.9216 / 24 / 48
doubao-seed-2.0-code[0,32] / (32,128] / (128,256]3.2 / 4.8 / 9.60.64 / 0.96 / 1.9216 / 24 / 48
doubao-seed-2.0-lite[0,32] / (32,128] / (128,256]0.6 / 0.9 / 1.80.12 / 0.18 / 0.363.6 / 5.4 / 10.8
doubao-seed-2.0-mini[0,32] / (32,128] / (128,256]0.2 / 0.4 / 0.80.04 / 0.08 / 0.162.0 / 4.0 / 8.0
doubao-seed-code[0,32] / (32,128] / (128,256]1.20 / 1.40 / 2.800.248 / 12 / 16
doubao-seed-1.6-lite[0,32] / (32,128] / (128,256]0.30 / 0.60 / 1.200.060.60 或 2.40 / 4.00 / 12.00
doubao-seed-1.6-flash[0,32] / (32,128] / (128,256]0.15 / 0.30 / 0.600.031.50 / 3.00 / 6.00
doubao-1.5-pro-32k无分段0.800.162.00
doubao-1.5-lite-32k无分段0.300.060.60

几个读表要点:

**doubao-seed-2.1-turbo 正好是 pro 的一半。**上一版只能写”媒体报道说大致是一半,是约数,建议核实”,这次官方数据确认了:pro 是 6.00/1.20/30.00,turbo 是 3.00/0.60/15.00,三项全部精确对半。如果你的任务不需要 pro 那档能力,这是个很干净的降本选择。

**缓存命中价基本是标价的两成。**几乎每一行的命中价除以输入价都是 0.2 左右。doubao-seed-code 稍微特别一点:它的缓存命中价固定 0.24 元,不随输入长度跳档——也就是说输入落在最贵的 (128,256] 档时,标价 2.80 元而命中价仍是 0.24 元,折扣力度反而放大到不足一折。长上下文的编程场景,把缓存吃好收益特别明显。

输出长度也可能影响档位。doubao-seed-1.6-litedoubao-seed-1.8 这类模型,在输入 [0,32] 这一档里还要再看输出:输出不超过 0.2K 时输出价 0.60 元,超过就跳到 2.40 元(1.6-lite)。分类、抽取这类短输出任务,卡住 max_tokens 能实打实省钱。

最便宜的档位便宜到什么程度:doubao-seed-2.0-mini 输入 0.2 元、doubao-seed-1.6-flash 输入 0.15 元、命中价 0.03 元。跑简单分类、意图识别这类活儿,成本基本可以忽略不计。

一个容易被忽略的事:方舟也在转售别家的模型

这次核实还发现一件上一版完全没提、但对选型很有价值的事——火山方舟不只卖豆包,也上架转售智谱和 DeepSeek 的模型,而且价格跟原厂比差异很大:

模型(在方舟上)输入缓存命中输出原厂同款价格
deepseek-v4-pro12.001.0024.00DeepSeek 官方:输入 3 元 / 输出 6 元
deepseek-v4-flash1.000.202.00DeepSeek 官方:输入 1 元 / 输出 2 元,命中 0.02 元
glm-5.28.002.0028.00智谱官方:输入 8 元 / 输出 28 元,命中 2 元
glm-4.7(三档)2.0 / 3.0 / 4.00.4 / 0.6 / 0.88 / 14 / 16与智谱官方一致

结论挺有意思:GLM 在方舟上和智谱官方同价,DeepSeek 却贵得多deepseek-v4-pro 在方舟是 12/24 元,原厂只要 3/6 元,差整整 4 倍;flash 档标价虽然一样,但缓存命中价从原厂的 0.02 元变成 0.20 元,差 10 倍——而缓存命中恰恰是 DeepSeek 最能省钱的地方。

这不是说方舟”坑人”,第三方平台转售要覆盖自己的成本,而且统一账单、统一控制台、统一鉴权本身就有价值。但如果你选方舟的理由是”上面能买到便宜的 DeepSeek”,那这个理由不成立;如果理由是”我本来就在用豆包,顺手把 DeepSeek 也放这儿省得多开一个账号”,那就要清楚这份省事的溢价是多少。

批量推理:五折,而且缓存照样能吃

如果你的任务能接受异步,走批量推理是最省事的降本手段。官方原文是”按 token 后付费,相比在线推理,价格低至 50%“,实际表里也确实是对半砍:doubao-seed-2.1-pro 从 6.00/30.00 变成 3.00/15.00,doubao-seed-2.1-turbo 从 3.00/15.00 变成 1.50/7.50。

值得注意的是,批量推理的表里仍然保留了缓存命中价这一列(比如 seed-2.1-pro 批量的命中价是 1.20 元),官方也写了”部分模型已支持透明前缀缓存能力,无需任何配置,享受命中缓存后的更低单价”。这跟有些平台”批量折扣和缓存折扣二选一”的规则不一样——在方舟这边,批量任务里的重复前缀依然能吃到缓存价,两种优惠不是互斥的。对于批量处理同一批参考文档这类场景,这个组合很划算。

Managed Agents 怎么计费

如果你用的是方舟的 Managed Agents(托管 Agent),计费是三项累加,跟单纯调模型不一样:

  • 模型调用:按实际调用的模型单价走,参见上面的在线推理表;
  • Agent 运行时(云端隔离沙箱,用于执行代码、读写文件、跑命令行):0.5 元/小时,只在 Session 状态为 running 时计费,idle、rescheduling、terminated 状态不计费;
  • 工具调用web_search 0.02 元/次web_fetch 限时免费。

另外官方写明首次开通赠送 30 小时 Agent 运行时 + 500 次 web_search,每个账号仅赠送一次,有效期 2 年。

这里最容易被低估的是运行时费用:0.5 元/小时看着不多,但如果你的 Agent 会话经常挂着不结束,一个月下来是笔固定开销,而且它和 token 用量无关——省 token 省不到它头上。好在 idle 状态不计费,这个设计还算合理,但前提是你的会话真的会进入 idle 而不是空转。

新用户免费额度

上一版写的是”新用户注册开通方舟后,豆包全系赠送 50 万 tokens 一次性免费额度”。这条本次没有在官方价格页上复核到,所以这里如实标注:它可能仍然有效、也可能已经调整,请以你注册时控制台实际显示的为准,别拿这个数字做预算依据。

同理,网上流传的”控制台开通管理页可加入协作奖励计划、每天再送 200 万 tokens”这条,本次依然没有从官方一手页面确认到,不当成既定规则来写。

本次能确认的免费资源只有前面说的 Managed Agents 那笔:30 小时运行时 + 500 次 web_search,一次性,有效期 2 年。

月成本怎么估算

公式的前提是先确认你这次调用的输入长度落在哪个分段:

单次成本 = 输入 token 数 / 1,000,000 × 该分段对应输入单价
         + 输出 token 数 / 1,000,000 × 该分段对应输出单价
月成本 ≈ 单次成本 × 每月请求数

举个例子,用 doubao-seed-code 估算一个每天 2,000 次的代码补全/问答场景,平均每次输入 10,000 token(落在 [0,32] 这一档)、输出 800 token:

  • 单次输入成本:10,000 / 1,000,000 × 1.20 元 = 0.012 元
  • 单次输出成本:800 / 1,000,000 × 8.00 元 = 0.0064 元
  • 单次合计:约 0.0184 元
  • 每天 2,000 次:约 36.8 元
  • 一个月(30 天):约 1,104 元

再看看缓存能带来多大差别。假设这个场景里有 70% 的输入是固定的项目上下文、能稳定命中缓存(命中价 0.24 元):

  • 命中部分输入:10,000 × 0.7 / 1,000,000 × 0.24 元 = 0.00168 元
  • 未命中部分输入:10,000 × 0.3 / 1,000,000 × 1.20 元 = 0.0036 元
  • 加上输出 0.0064 元,单次约 0.0117 元
  • 一个月:约 702 元

同样的活儿,把缓存吃好省了三成六。如果再叠上批量推理的五折(前提是能接受异步),还能再往下压一大截。

豆包这边模型迭代和调价都比较频繁——从 Seed 1.6 到 1.8、2.0、2.1 Pro,再到现在的 Seed-Evolving,节奏很快。正式立项前建议直接打开控制台的价格计算器跑一次真实用量估算,比拿任何一篇文章里的数字外推都靠谱。

常见坑 / 注意

  • 分段计费别当成固定单价:同一个模型,输入长度不同会落进不同价格区间,且整次请求(含输出)都按那一档结算,不是超出部分单独加价。
  • 输出长度也会跳档doubao-seed-1.6-litedoubao-seed-1.8 在短输入档里还看输出长度,超过 0.2K 输出价跳几倍。短输出任务卡住 max_tokens
  • doubao-seed-code 的缓存命中价不跳档:固定 0.24 元,输入越长折扣力度越大,长上下文编程场景优先做缓存优化。
  • 别为了买便宜 DeepSeek 而来方舟deepseek-v4-pro 在方舟 12/24 元,原厂 3/6 元,差 4 倍;flash 的缓存命中价差 10 倍。GLM 倒是同价。
  • 批量和缓存在方舟可以同时吃:跟某些平台”二选一”的规则不同,批量表里保留了缓存命中价。
  • Managed Agents 的运行时费用与 token 无关:0.5 元/小时按 running 时长算,省 token 省不到它头上,注意会话别空转。
  • 50 万 tokens 新人额度本次未复核:以控制台实际显示为准,别拿它做预算依据。
  • “每日 200 万 tokens 协作奖励”仍未获官方确认:用前自己去控制台核实。
  • 官方价格页是 JS 渲染:自己核实时记得用浏览器直接打开,简单抓取工具会拿到空壳。

接下来看什么

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。

留言讨论

评论发布后会被人工复核,违规内容将被删除。

    还没有人评论,来说说你的看法

    如果发表没有反应,可以前往联系我们告诉我们。

    这个页面有问题?

    提交时会附带当前页面地址和浏览器信息,帮助我们定位问题。不填联系方式即为匿名。