硅基流动免费模型有哪些?怎么查当前可用清单
数据截至 2026-08,价格与限额以各官网为准。本文只讲计费与接入机制,不列具体价格数字。
先把结论说完:想找”硅基流动免费模型有哪些”,去官方文档里翻一份现成的名单是找不到的,文档给出的是一条判定规则加一个查询入口。规则是——部分模型同时提供免费版与收费版,免费版沿用模型的原名称,收费版在名称前面加 Pro/ 前缀;具体每个模型的限额,官方让你去模型广场查。所以”当前可用清单”这件事,正确的做法不是背名单,而是记住”名字前面有没有 Pro/”这个判据,再到模型广场核对你要用的那个模型此刻是什么状态。另外有两道门容易被忽略:一是实名认证,官方明确写着实名之后才能使用全部免费模型;二是免费版的限额是固定的,不会随着你在平台上花得多而放宽。
官方给的不是清单,是一条命名规则
这一点值得单独强调,因为它决定了你该怎么”查”。
按官方文档的说法,平台上有一部分模型是同时存在两个版本的:一个免费版,一个收费版。两者在接口层面就是两个不同的模型名称字符串——免费版按模型的原名称命名,收费版在名称前面加上 Pro/ 前缀。也就是说,你在请求体的 model 字段里填的名字里带不带这个前缀,直接决定了这次调用走的是哪一档。
这个设计有点反直觉的地方在于:切换免费版和收费版,不是在控制台里点一个开关,而是改代码里的模型名字符串。好处是切换成本极低、也不存在”我以为切了其实没切”的状态误判;代价是模型名写错时不会有自动降级这回事。官方文档给了一个错误响应示例,形态是这样的:code 字段带一个平台自定义的数字码,message 是 Model does not exist. Please check it carefully.。
还要注意,官方的说法是只有一部分模型存在双版本。并不是平台上每个模型都有免费/收费双版本,也不是没有 Pro/ 前缀的模型就一定免费。所以这条规则是用来区分同一模型的两个版本的,不能反过来当成”凡是不带前缀的都不要钱”来用。要确认某个具体模型此刻的状态,官方指的路径只有一条:去模型广场查。至于文档里有没有提供一个可以拉取免费模型列表的接口,官方文档里没有找到相关说明,我不替它补。
免费版和 Pro 版真正的差别:限额口径和能用哪种余额
名字只是表面,底下有两处实质差异,都写在官方文档里。
第一处是限额口径不同。免费模型的 Rate Limits 是固定值;收费模型的限额则按账户的用量级别分层,级别越高、限额越宽。而用量级别是按月消费金额划分的——官方的算法是取”上月”和”当月 1 号至今”这两个数中较高的那个来换算级别,达标即自动升级、立即生效,新注册用户从最低档起步。这里有个连带结论值得记住:你在平台上花得再多,免费模型那一档的限额也不会跟着涨,它压根不参与分层。想靠”多充值来把免费模型的额度撑大”是走不通的,这条路只对收费模型有效。
第二处是能用哪种余额付账。官方文档在讲 DeepSeek R1 与 V3 时说得很明白:这两个模型是按支付方式来区分命名的,带 Pro/ 前缀的版本仅支持充值余额支付,不带前缀的版本则同时支持赠费余额和充值余额支付。换句话说,平台账户里的钱不是一个数,至少分成”赠费余额”和”充值余额”两本账,而模型名决定了这次调用能动哪一本。这解释了一个常见的困惑:明明账户里显示还有余额,调 Pro/ 开头的模型却付不出去——很可能是余额都在赠费那一侧。顺带一提,用量级别的月消费金额是把赠送金额也算进去的。
实名认证:免费模型真正的第一道门
很多人以为”免费”等于注册完就能随便调,硅基流动这边不是。
官方文档在实名认证一节里写着两条硬要求:一是依据《中华人民共和国网络安全法》等法规要求做实名认证;二是实名之后才能使用全部免费模型。注意官方的措辞是”全部”,至于未实名的账号具体还能调用哪些模型、能不能调,官方文档未作进一步说明,我不去推断。
未实名还有两个明确后果,官方直接列了出来:无法充值、无法申请开发票。
认证分个人和企业两类,这个选择不是随便点的——账号归属和开票资质都由认证类型决定,官方还专门提醒企业用户不要去做个人实名认证,并且一个账号只允许绑定一个认证主体。个人认证走支付宝 App 扫码人脸识别;企业认证有两种路径,法人人脸识别,或者企业对公打款(平台打一笔小额随机金额到对公账户,通常十分钟内到账,你把收到的金额回填完成核验)。
有两条限制建议提前想清楚再动手:30 天内只能完成一次变更或修改,以及平台不对未成年人提供在线实名认证服务。第一条意味着认证主体选错了,你要等一个月才能改;第二条是资格问题,不是流程问题。个人认证支持的证件类型官方也列了,除身份证外还包括港澳往来大陆通行证、台湾往来大陆通行证、港澳居民居住证、台湾居民居住证、外国人永久居留证,这些之外的证件官方说明暂不支持线上认证(以官方文档为准)。
免费模型也会被限流,而且是按账户算的
免费不等于不限速。硅基流动的限流体系一共有七种指标:RPM(每分钟请求数)、RPH(每小时请求数)、RPD(每天请求数)、TPM(每分钟 token 数)、TPD(每天 token 数)、IPM(每分钟图片数)、IPD(每天图片数)。这套枚举以官方文档为准。
有三条判定规则决定了你会不会莫名其妙撞墙:
- 任一指标先达峰就触发限流,不需要七项全都超。官方自己举的例子是:请求数限额和 token 数限额同时存在时,一分钟内把请求数打满,哪怕 token 总量还剩很多没用,限流一样会触发。写成条件就是 OR 不是 AND,这是最容易理解反的一条。
- 限额定义在用户账户级别,不是 API Key 维度。多申请几把 Key 分摊流量是无效的,它们共用同一个账户的额度。
- 每个模型单独设置限额,一个模型超限不影响其他模型。所以撞了限流之后换一个模型继续跑,在机制上是成立的。
触发之后返回 429,官方给的报错原文是 Request was rejected due to rate limiting. If you want more, please contact contact@siliconflow.cn。处理方式官方推荐等待后重试并采用指数退避。限流这块的通用工程做法,可以再看这篇 API 报 429 的正确处理姿势 和 RPM 与 TPM 的口径与并发估算,平台侧的细节则在 硅基流动速率限制机制 里讲得更细。
调不通时,按错误码分流
找免费模型的人最后往往卡在”为什么调不通”上。官方错误码表里有几个含义是明确的,照着分流比乱试快:
- 401:API Key 没有正确设置。先确认请求头是不是
authorization: Bearer <你的 apikey>这个形态,以及 Key 有没有粘贴完整。 - 402:账户欠费,官方给的处理是充值后重试。
- 403:权限不够,官方特别注明最常见的原因是该模型需要实名认证——这一条和上面那道门是同一件事,找免费模型时撞上 403 先回头看认证状态,其他情况看返回的 message。
- 429:触发限流,按 message 判断具体是七种指标里的哪一种超了。
- 503 / 504:服务负载较高,稍后再试;对话和 TTS 请求可以尝试改成流式输出。
- 400:参数不正确,按 message 修正非法请求参数。
- 500:未知错误,联系官方排查。
官方还给了一套通用排查步骤,顺序是:打印错误码和 message;用 curl 复现一次,排除客户端封装的干扰;换一个模型试,判断是模型问题还是账户问题;如果开了代理就关掉代理再试。最后一条经常是真凶,尤其是在本地开发机上。
接进代码之前还要确认的两件事
模型名确认完了,还有两处官方明确提过的坑。
一是 max_tokens。官方说明该参数与上下文长度相等,但同时提醒部分模型的推理服务在更新中,不要把它设成最大值,建议给输入内容留出足够余量。输出被截断时,第一个要查的就是这个参数是不是设得不合适;非流式的长输出还容易撞上超时,官方建议改成流式,并把客户端的超时时间调大。第三方客户端也有自己的限制,官方点名 Cherry Studio 的默认输出长度上限需要先打开”开启消息长度限制”开关才能调整。
二是输出乱码。官方说部分模型在不设采样参数时容易出现乱码,可以尝试设置 temperature、top_k、top_p、frequency_penalty 这几个参数。这不是玄学调参,是官方文档里给的排查方向。
接入的基础形态也顺带说一句:API 基址是 https://api.siliconflow.cn/v1,聊天端点在 /chat/completions,平台兼容 OpenAI 与 Anthropic 的对话协议,大语言模型可以直接用 OpenAI 官方库,把 base_url 指向上面的基址即可,官方示例要求 Python 3.7.1 或更高版本。要看完整的模型名核对流程,可以接着读 硅基流动模型清单怎么查。
最后:别把”清单”当成一次性工作
回到开头那个问题。“免费模型有哪些”之所以没有标准答案,是因为它本来就是个会变的东西——平台随时可能调整某个模型的档位、限额和分层规则。真正稳定的只有三样:Pro/ 前缀这条命名规则、模型广场这个查询入口、以及免费版限额固定不随等级变化这条设计。
所以更划算的做法是把判断逻辑写进流程,而不是把名单抄进备忘录:调用前先确认模型名字符串(带不带前缀)、确认账户实名状态、确认这次调用要动的是哪一本余额;跑起来之后按错误码分流,402 看余额、403 看认证、429 看限额。把这四步固化下来,下次平台调整了什么,你只需要重新去模型广场核对一遍,不用把整套接入逻辑重写。
留言讨论
评论发布后会被人工复核,违规内容将被删除。
如果发表没有反应,可以前往联系我们告诉我们。