腾讯混元的免费额度有多少?三套计费口径别搞混

2026-07-27

数据截至 2026-07,价格与限额以各官网为准。

混元的”免费额度”不是一个能一句话说死的数字,而是取决于你开通的是哪一套服务——原生 API、智能体开发平台、TokenHub 是三套独立的计费体系,额度和单价都不通用。真正可信的数字只有一个来源:你自己登录控制台开通服务那一刻,页面上显示的那个额度。

先承认一个很普遍的误解:不少人是从”腾讯元器免费 token 额度提升到 1 亿”这类消息里第一次听说混元免费额度的,于是默认自己开通混元 API 之后也有一亿 token 可用。这个理解是错的。元器是智能体分发平台,它的额度是它自己那套体系的,跟你在混元原生 API 上按 token 计费的调用不是一个池子。把两者混在一起算账,做出来的成本预估会差出好几个数量级。

这篇不重复列价格表(那部分在腾讯混元 API 怎么收费里已经写过),只专门解决一件事:把免费额度和计费口径这两个最容易糊涂的地方讲清楚。

先把三套计费体系分开

这是所有混淆的根源。混元这条产品线目前同时存在三套定价逻辑,各算各的:

第一套:原生 API,按 token 后付费。 这是最经典的形态,调用 chat/completions 或 Anthropic 兼容端点,按输入输出 token 数计费,单位统一是”元 / 百万 tokens”。免费额度这个概念主要属于这一套。

第二套:智能体开发平台的”套餐订阅”。 官方文档里 Tencent HY 2.0 Instruct(对应 hunyuan-turbos-latest)、Tencent HY 2.0 Think(对应 hunyuan-T1-latest)在这个平台上共用同一个计费项,但它给的单价是”PU 资源”口径,跟按 token 计费不是同一个计量单位,不能直接换算比较。该计费方式官方说明是从 2026-01-09 起分批灰度上线。

第三套:TokenHub 的 Hy Token Plan。 这是面向编码 Agent 的订阅套餐,分 Lite / Standard / Pro / Max 四档,官方称同等用量下比通用版更优惠。但它有一条很硬的使用边界,后面单独说。

只要你脑子里先把这三套分开,很多”为什么两个页面价格对不上”的疑惑就自动消失了——它们本来就不在描述同一个东西。

官方文档里的免费额度,原话是怎么写的

混元生文计费概述页给出的表述是:混元生文(不包含 Hunyuan-lite)及混元多模态模型共用 100 万 token 免费调用额度,资源包有效期 1 年,自开通服务之日起 1 年内未用完则过期作废。

这句话里有四个限定条件,每一个都值得单独拎出来:

  • “共用”:不是每个模型各给 100 万,是所有覆盖到的模型合起来一个池子。你用视觉模型跑掉的量,也会从这 100 万里扣。
  • “不包含 Hunyuan-lite”:lite 被明确排除在这个额度之外。至于 lite 当前是否还在售、是否还沿用早年”免费”的政策,官方 2026-07 的计费页模型列表里并没有它,这一点我不替官方下结论,以控制台实际可选的模型列表为准。
  • “生文 + 多模态”:向量模型、角色扮演、翻译这些是否全部算在同一个池子里,页面表述没有逐一列举,实际以开通后控制台的额度明细为准。
  • “自开通之日起 1 年”:起算点是开通日,不是首次调用日。开完账号放着不用,时间照样在走。

为什么不同渠道说的数字不一样

如果你搜过这个问题,大概率会看到几个互相打架的说法:有说 100 万的,有说”每个开通服务的账号累计 10 万 token”的,还有说”完成实名认证赠送 100 万”的。

我的处理方式是把它们如实并列,不挑一个当作标准答案。原因很简单:这些描述来自不同渠道、不同时间点,而混元这条产品线正处在往 TokenHub 迁移的过渡期,页面和政策随时可能改。官方文档在多个位置反复挂着同一条提示——相关功能将逐步迁移至 TokenHub,迁移后原平台不再新增模型能力、停止支持新购模型服务,已购买的服务可继续使用。

产品线在搬家的过程中,新旧两套文档同时在线、数字对不上,是很正常的现象。所以这里给一条可操作的做法:别信任何二手数字,包括这篇。开通服务的时候,把控制台上显示免费额度的那个页面截图存下来,写上日期。 后面对账、扯皮、做成本预估,都以这张截图为准。这比在搜索结果里比对哪个数字更”权威”要靠谱得多。

100 万 token 大概值多少钱、能干多少事

这一节的换算是我按官方计费页上的单价折算的,不是官方给出的结论,仅供你建立量级感。

按当前计费表里主力文本模型 Hunyuan-a13b 的单价——输入 0.5 元 / 百万 tokens,输出 2 元 / 百万 tokens——来估:100 万 token 如果全用在输入上,折合大约 0.5 元;如果全算成输出,折合大约 2 元。真实场景是输入输出混着走,那么这份免费额度对应的金额量级,大致就在几毛到两块钱之间

这个结论听起来有点扫兴,但它其实很有用:混元的免费额度更像一张”试用通行证”,而不是一笔能省钱的预算。 它的意义是让你在不绑扣费的心理负担下,把接入链路跑通、把返回格式验一遍、把兼容端点试明白。指望靠它长期跑业务,方向从一开始就不对。

换个角度看能干多少事:a13b 官方标注最大输入 224K、最大输出 32K tokens,如果你真拿一份接近上限的长文档去做一次全量分析,单次就可能吃掉总额度的两成以上。反过来,如果是短问答,一次几百到一两千 token,100 万够跑几百上千轮。所以”能撑多久”这个问题没有通用答案,完全取决于你的单次上下文有多长——这也是为什么我建议你在跑通 demo 之后立刻做用量埋点,而不是等额度报警才开始关心。

计费口径里最容易踩的几个细节

模型清单在变,旧教程里的模型名不一定还在。 2026-07 的官方计费表里实际列出的是 Hunyuan-a13b、Hunyuan-role-latest、Hunyuan-translation 与 translation-lite、几个 vision 系列、Hunyuan-embedding,以及腾讯元器。而 hunyuan-turbos-latest、hunyuan-lite、hunyuan-standard、hunyuan-pro 这几个名字没有出现在这张最新计费表里。它们是并入了别的计费口径、迁去了 TokenHub、还是文档正在改版,官方页面没有解释,我也不猜。

turbos 和 T1 的单价能查到线索,但要打问号。 官方购买指南 PDF 及多篇计费说明文章反复用同一组数字做算例,指向 turboS 系列:输入 0.8 元、输出 2 元每百万 tokens;T1 系列则是输入 1 元、输出 4 元每百万 tokens。这些数字出现在计费示例里,而不是独立价格表里,所以当作参考量级可以,写进正式预算之前必须自己去控制台核一次

元器那一行不是普通模型。 计费表里”腾讯元器”标的是输入输出各 100 元 / 百万 tokens,比一般文本模型贵两个数量级。它是智能体分发平台,不是基础模型,别看到同一张表就以为可以横向比价。

embedding 的输入输出同价。 向量模型 Hunyuan-embedding 标注输入 0.7、输出 0.7 元每百万 tokens,接口参数上也有收敛:目前仅支持 inputmodel 两个参数,model 固定为 hunyuan-embedding,dimensions 固定 1024。做 RAG 选型时这几个固定值会影响你的向量库设计,值得提前知道。

Hy Token Plan 有一条硬边界

如果你的目标是”用国产模型省着跑 Claude Code”,那 TokenHub 的 Hy Token Plan 会很吸引你——官方明确列举它支持 OpenClaw、Claude Code、OpenCode、Cline、Cursor、Kilo Code、Codex CLI 等工具共享套餐额度。

但官方同时写了一条限制,原话的意思是:该套餐仅限在 AI 工具中使用,禁止以 API 调用的形式用于自动化脚本、自定义应用程序后端或任何非交互式批量调用场景

这条约束的实际含义是:套餐是给”人坐在编辑器前交互式写代码”这个场景准备的,你不能买一份套餐然后把它接到自己的服务端去跑定时任务或批量处理。如果你的需求是后者,老老实实走原生 API 按 token 计费那条路,别在这条线上省钱。至于套餐每档具体多少钱,我没有核到独立价目表,以 TokenHub 官网或控制台当前页面为准。

顺带说一句接入层面的事实:混元同时提供 OpenAI 兼容和 Anthropic 兼容两条接口,base_url 分别是 https://api.hunyuan.cloud.tencent.com/v1https://api.hunyuan.cloud.tencent.com/anthropic,官方文档里还专门写了通过 Claude Code 接入的一节。具体接法在混元 API 接入这篇里已经展开过。

这里要诚实补一句准入前提:Anthropic 官方受支持地区列表不含中国大陆(anthropic.com/supported-countries)。所以”用 Claude Code 这个客户端 + 混元的模型服务”是一回事,“直接用 Anthropic 官方的模型服务”是另一回事,两者不能混为一谈;本文不提供也不背书任何第三方中转渠道,具体以各厂商官网当前的地区政策页为准。

免费额度用完之前,建议先做三件事

  • 做用量埋点。 每次调用把返回里的 token 用量记下来,按业务场景分类累计。等你能说出”一次客服对话平均消耗多少 token”,成本预估才有意义,否则永远是拍脑袋。参考大模型 token 成本怎么优化里的思路。
  • 把模型选型验完。 免费额度最该花在对比上:同一批真实请求,分别用 a13b、翻译模型、vision 模型跑一遍,看质量差距值不值单价差距。等开始付费了再做对比,心理成本就高了。
  • 确认自己该待在哪套体系里。 交互式写代码 → 看 TokenHub 套餐;服务端批量调用 → 原生 API 按 token;做智能体编排 → 看智能体开发平台那套 PU 口径。选错体系,后面所有成本优化都是白做。

这篇的局限,说在前面

我能给的确定性是有限的,得说清楚:混元这条产品线正在迁移期,计费页、购买指南、智能体平台文档三处口径本来就不完全一致;免费额度的具体数字在不同渠道有不同说法;turbos / T1 的单价只见于计费算例而非独立价格表;TokenHub 套餐的具体价格我没有核到。这些不确定的地方,我宁可标出来,也不给你一个看着整齐、实际可能过时的数字。

同样的思路也适用于横向对比。想看别家免费额度的算法,可以参考通义千问免费额度实测国产 API 免费档对比;混元调用报错的排查在混元 API 常见报错

小结

混元的免费额度,官方文档给的是”生文(不含 lite)及多模态共用 100 万 token、有效期 1 年、过期作废”,但不同渠道存在不一致的说法,最终以控制台开通时显示的为准。按计费表单价折算,这份额度的金额量级只有几毛到两块钱,定位是试用通行证而非省钱预算。原生 API、智能体平台套餐、TokenHub 订阅是三套独立计费体系,单价口径不可互换比较,元器的额度更不能算进混元 API 的账。TokenHub 的 Hy Token Plan 有明确边界——只能在 AI 工具里交互式使用,不能当后端 API 跑批。最省事的做法是:开通当天截个图,跑通链路后立刻做用量埋点,剩下的以官方最新说明为准。

接下来看什么

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。