SiliconFlow 硅基流动怎么收费?各模型单价、免费额度与计费机制
数据截至 2026-07,价格与限额以各官网为准。
SiliconFlow 不是一口价平台,它按你实际调用的底层模型分别独立计价,单位是「¥/M Tokens」(每百万 token),DeepSeek 系列和 Qwen 系列、GLM 系列价格都不一样,同一个系列不同参数量、不同版本价格也不一样;想控制成本,第一件事不是找”SiliconFlow 多少钱一次调用”这种笼统答案,而是先确认你打算用哪个具体模型。
这篇把计价规则、免费档、余额规则和月成本估算一次讲完,顺带说清楚一个容易被第三方文章带偏的点:网上流传的”新用户注册送¥14”这类具体数字,官方协议文档里其实没有查到,不建议写进任何正式报价或者成本模型里。
计费机制:按底层模型分别计价,没查到统一加价层
SiliconFlow 的计费单位是「¥/M Tokens」,输入和输出分别标价,部分模型还单独标了缓存命中价。这套单价是”跟着模型走”的——你调 deepseek-ai/DeepSeek-V4-Pro 和调 Qwen/Qwen3-32B,账单上的单价完全是两回事,平台不是把所有模型统一按一个价格卖,而是每个模型独立定价、独立计费。
官方文档里目前没有查到”平台在模型方官方定价基础上加价百分之多少”这类说明,也就是说,定价页上写的数字,大概率就是你实际要付的钱,没有隐藏的加价层公开条款。这一点本文只能如实说”未查到”,不代表一定不存在,具体以你登录账号后看到的实时账单和官网当前定价页为准。
不少模型还分免费版和 Pro(付费加速)版两档:同一个模型架构,免费版限速限并发比较明显,Pro 版价格更高但速率限制更宽松。选型的时候不能只看模型名字对不对,还要确认自己调的是免费版还是 Pro 版,因为账单上这两档是分开计价的。
代表模型单价:先看几个真实数字
以下单价来自定价页内嵌数据(2026-07-02 快照,¥/M Tokens):
| 模型 | 输入 | 输出 |
|---|---|---|
| deepseek-ai/DeepSeek-V4-Flash | ¥1 | ¥2 |
| deepseek-ai/DeepSeek-V4-Pro | ¥12 | ¥24 |
| deepseek-ai/DeepSeek-V3.2(Pro) | ¥2 | ¥2 |
| deepseek-ai/DeepSeek-V3(Pro) | ¥2 | ¥8 |
| deepseek-ai/DeepSeek-R1(Pro) | ¥4 | ¥16 |
| Qwen/Qwen3-32B | ¥1 | ¥4 |
| Qwen/Qwen2.5-7B-Instruct(Pro) | ¥0.35 | ¥0.35 |
| zai/GLM-4.5-Air | ¥1 | ¥6 |
| moonshotai/Kimi-K2.6(Pro) | ¥6.5 | ¥6.5 |
看这张表能感受到价差有多大:便宜的小模型 Qwen2.5-7B-Instruct 输入输出都是 ¥0.35,贵一档的 DeepSeek-V4-Pro 输出单价是 ¥24,相差接近 70 倍。所以真实项目里选模型不能只看”能不能用”,成本敏感的场景先把候选模型的单价摆出来比一遍,很多时候小一档的模型跑常规任务够用,价格却差出一大截。
需要提醒一句:模型上新、调价在这类聚合平台上比较频繁,上面这张表是某一次快照,具体计费仍以你登录账号后看到的定价页 siliconflow.cn/pricing 或者调用 GET /v1/models 接口拿到的实时数据为准,写报价单前建议当场再核实一遍,别直接抄旧文章里的数字。
免费模型档:完全 ¥0,但别当成生产环境的唯一依赖
SiliconFlow 上有一批完全免费的模型可以用来测试或者跑轻量任务,比如 Qwen/Qwen3-8B、Qwen/Qwen3.5-4B、Qwen/Qwen2.5-7B-Instruct(免费版)、THUDM/GLM-4-9B-0414、THUDM/GLM-Z1-9B-0414、tencent/Hunyuan-MT-7B、deepseek-ai/DeepSeek-OCR、deepseek-ai/DeepSeek-R1-0528-Qwen3-8B(Free)。这些模型输入输出都是 ¥0,跑通接入流程、做小规模验证完全够用。
但免费版通常伴随着更严格的限速和限并发,业务量一大就容易碰到限流;而且免费模型的上下线也比付费模型更频繁,今天能用的免费模型不代表三个月后还在架。如果只是学习和验证阶段用免费模型没问题,一旦要接入真实产品跑量,还是建议对照定价页评估一下换成 Pro 版或者付费模型的成本,别把生产环境的可用性完全押在一个免费额度上。
充值余额 vs 赠送余额,别搞混
官方《用户充值协议》里把余额分成两种,概念区分很清楚:
- 充值余额:你实际支付的人民币,没有使用期限;通过微信支付在线充值完成后 360 日内,未消费部分可以自行申请退款,每笔限一次。
- 赠送余额:平台不定期搞的充值优惠活动、邀请奖励之类额外赠予的余额,不可提现、不可转让、不可开票,最终解释权归平台。
这个区分对做成本核算和报销的人尤其重要——如果你的账户余额里混了赠送余额,账面上看起来”还有钱”,但这部分钱不能提现也不能开票,做财务对账的时候要分开算,别把赠送余额当成可自由支配的现金资产来处理。
关于”新用户送¥14”:别写死这个数字
网上不少第三方评测文章提到”新用户注册送¥14,邀请好友再送¥14”,但翻遍官方《用户充值协议》原文,并没有查到这个具体金额的条款。更关键的是,协议里明确写着一个时效变化:2025-11-30 之后,平台的激励发放形式已经从”赠送余额”改成了”代金券”(用户可以在”余额充值 > 代金券”里查看),也就是说即便早年确实存在过某个具体赠送金额,发放机制本身也已经变了,继续沿用旧文章里”送¥14”这个说法大概率已经过时。
这也是为什么本文不写死这个数字:一是官方协议正文没有这个金额的书面依据,二是就算历史上真有过,发放形式已经切换成代金券,旧数字对不上现状。如果你要在自己的文章或者报价单里提到新用户福利,建议的做法是登录官网实际看一眼当前弹窗或者”代金券”页面显示的是什么,而不是抄网上流传的旧数字。
省钱法
结合前面几点,几条能直接落地的省钱思路:
- 先比价再选模型:同样能完成任务的前提下,优先选单价更低的一档,
Qwen2.5-7B-Instruct和DeepSeek-V4-Pro差出几十倍价格,很多简单任务小模型就够用。 - 验证阶段用免费模型:跑通调用流程、做小范围效果测试时先用免费档,不占用充值余额,等确认方案可行了再切到付费模型或者 Pro 版跑量。
- 分清充值余额和赠送余额再做预算:赠送/代金券部分不能提现开票,做成本预算时按充值余额的实际支出来算,别把账户显示的总余额直接当成可报销金额。
- 调用前核实当前单价:模型调价、上下线比较频繁,正式报价或者接入生产环境之前,去
siliconflow.cn/pricing或者GET /v1/models接口确认一次实时数字,别直接套用某篇文章里的旧价格表。
月成本怎么估算
给一个能直接套的公式:
单次成本 = 输入 token 数 / 1,000,000 × 该模型输入单价
+ 输出 token 数 / 1,000,000 × 该模型输出单价
月成本 ≈ 单次成本 × 每月请求数
举个例子,用 deepseek-ai/DeepSeek-V4-Flash(输入 ¥1、输出 ¥2,每百万 token)估算一个每天 3,000 次请求的问答功能,平均每次输入 1,500 token、输出 400 token:
- 单次输入成本:1,500 / 1,000,000 × 1 元 = 0.0015 元
- 单次输出成本:400 / 1,000,000 × 2 元 = 0.0008 元
- 单次合计:约 0.0023 元
- 每天 3,000 次:约 6.9 元
- 一个月(30 天):约 207 元
如果同样的量级换成单价更高的 deepseek-ai/DeepSeek-V4-Pro(输入 ¥12、输出 ¥24),同样的 token 量算下来月成本会涨到十倍以上。这也是为什么前面反复强调”先确定用哪个具体模型”——脱离具体模型型号谈”SiliconFlow 多少钱”是没有意义的,模型选型本身就是成本控制里权重最大的一环。
常见坑 / 注意
- 单价按模型走,不是平台统一定价:报价前先确认你用的是哪个具体模型 id,DeepSeek 系列和 Qwen、GLM、Kimi 系列价格互相之间差异很大。
- 免费版和 Pro 版是两档账单:同一模型可能免费版和 Pro 版并存,限速不同、计费也不同,别把两者的价格搞混。
- 赠送余额/代金券不能提现开票:做财务核算时和充值余额分开算,别当成可自由支配的现金。
- “新用户送¥14”这类具体数字别写死:官方协议正文未查到该条款,且 2025-11-30 后发放形式已改为代金券,旧数字大概率已过时,以登录官网实际页面为准。
- 是否存在平台加价机制未公开:官方文档没有查到”在模型方官方价基础上加价”的说明,定价页数字视为用户实付单价,但不排除后续政策调整,以官网当前页面为准。
- 模型上新调价较频繁:写报价单或者接入生产环境前,建议当场核实一次
siliconflow.cn/pricing或GET /v1/models的实时数据。