硅基流动模型清单怎么查:模型广场、命名规则与选型注意
数据截至 2026-08,价格与限额以各官网为准。本文只讲计费与接入机制,不列具体价格数字。
「硅基流动模型清单怎么查」这个问题,真实的答案分成三层:模型叫什么名字、这个名字你有没有权限调、这个名字对应的限额是多少。三层是分开的,只看第一层会踩坑。 官方文档里唯一明确写到模型广场的地方,是说具体模型的限额在那里查;清单也只能回那里看;而模型名本身携带了两条硬信息——对那些同时提供免费与收费两版的模型,官方的命名约定是收费版在名称前加 Pro/ 前缀;另外官方对 DeepSeek R1 与 V3 单独说明了两版可用的余额类型不同。至于名字写错、权限不够、账户欠费、限额触顶,平台会用四个不同的错误码分别告诉你,这四个码的含义完全不同,别混在一起排查。下面按「查名字 → 读名字 → 验权限 → 核参数」的顺序展开。
先说清楚:官方唯一明确的模型广场用途是查限额
本文所依据的官方文档页面(快速上手、错误码、限流与升级、财务、鉴权等几页)里,能查到的关于「去哪里看模型」的明确说法只有一条:具体模型的限额在模型广场查询。至于是否存在一个可以用 HTTP 请求拉取全量模型列表的接口、该接口的路径与返回字段是什么,这些页面里没有找到相关说明,以官方文档当前版本为准。
这一点值得单独交代,因为不少人默认「兼容 OpenAI 协议 = 什么都一样」。硅基流动官方写明的是兼容 OpenAI 与 Anthropic 的对话协议,大语言模型可以直接用 OpenAI 官方库调用,只需要把 base_url 指向 https://api.siliconflow.cn/v1。请注意这句话的限定范围是「对话协议」——它保证的是对话请求的收发格式,并不构成对其他管理类接口的承诺。所以想拿模型清单,稳妥做法是回到控制台的模型广场看,而不是凭对其他平台的印象去猜一个路径出来试。
顺带把接入的几个基础事实钉一下,免得清单查对了却连不上:API 基址是 https://api.siliconflow.cn/v1,聊天端点是 https://api.siliconflow.cn/v1/chat/completions,鉴权头的写法是 authorization: Bearer <你的 apikey>,API Key 在「API 密钥」页面新建,官方示例要求 Python 3.7.1 或更高版本。这几项的细节可以看硅基流动 API 接入配置。
模型名里的 Pro 前缀,是清单里信息量最大的地方
这是硅基流动区别于多数平台的一条命名约定,也是查清单时最容易看漏的一条:
部分模型同时提供免费版与收费版。免费版沿用原名称,收费版在名称前面加 Pro/ 前缀。 也就是说,同一个底层模型,你在清单里可能会看到两条记录,区别只在开头那四个字符。
这条规则往下还带出两个后果,都是实打实会影响你调用结果的:
第一,限额规则不同。免费版的 Rate Limits 是固定的,不会因为你充了多少钱而变宽;收费版的 Rate Limits 则随账户的用量级别变化,级别越高限额越宽。所以有人发现「同一个模型,别人跑得动我跑不动」,多半不是玄学,而是一边用的是免费版一边用的是 Pro/ 版。
第二,支付方式不同,而且是按名字区分的。官方对 DeepSeek R1 与 V3 的说明写得很直白:Pro/ 版仅支持充值余额支付,非 Pro 版支持赠费余额和充值余额支付。这意味着如果你账上只剩赠费余额,把模型名从非 Pro 换成 Pro/ 开头的那一条,这笔钱就付不了了;至于此时平台具体返回什么,官方文档没有说明。反过来,如果你正在排查「明明有余额却提示不足」,先看一眼模型名前面那四个字符,比翻账单快得多。
写代码时的一个建议:把模型名抽成配置项,不要硬编码散落在各处。前缀差异带来的行为差异太隐蔽,集中管理才有机会在一个地方改完。
名字写错时,平台会明确告诉你是哪一类问题
清单查错的表现不一定是「报错说找不到模型」,也可能是别的码。官方错误码表里,这几个的含义是分开的(以官方文档为准):
- 20012 /
Model does not exist. Please check it carefully.:这是官方给出的错误响应示例中的业务码与文案,字面意思就是模型不存在,请仔细核对。看到它先查拼写、大小写与Pro/前缀。 - 400:参数不正确,按返回的 message 修正非法的请求参数。模型名对了但别的字段传错,落在这一档。
- 403:权限不够。官方特别点明,最常见的原因是该模型需要实名认证;其他情况看 message。
- 402:账户欠费,充值后重试。
- 429:触发了 rate limits,需要按 message 判断触顶的是 RPM / RPD / TPM / TPD / IPM / IPD 中的哪一种。
区分这几个码的实际价值在于:403 和 20012 表现上都像「这个模型我用不了」,但一个是权限问题、一个是名字问题,处理路径完全相反。先看码再动手,能省掉大量瞎试。
官方给的通用排查步骤也适用于清单类问题:先把错误码与 message 打印出来,再用 curl 复现一次以排除客户端封装的干扰,然后换一个模型试试以判断问题是模型特有的还是全局的,最后——如果开了代理,关闭代理再试。更完整的报错分流可以看硅基流动报错排查。
实名认证是清单可用性的前置条件
这条容易被当成纯合规流程略过,但它直接决定你清单里哪些条目真的能调。官方的说法是:依据《中华人民共和国网络安全法》等法规要求进行实名认证,实名之后才能使用全部免费模型;不实名的直接后果是无法充值、无法申请开发票。
配合上一节的 403 一起看就很清楚了:你在模型广场看得到某个模型,不代表你当前账户状态下调得通。「看得到」和「调得通」是两件事,中间隔着实名认证这道门。
认证本身还有几个机制性的点值得记住:分个人认证与企业认证,账号归属与开票资质都由认证类型决定;一个账号只允许绑定一个认证主体;30 天内只能完成一次变更或修改。最后这条尤其要注意——企业用户如果一开始图省事做了个人实名认证,想改回来要受这个时间窗限制。官方也明确写了企业用户不要做个人实名认证,以及不对未成年人提供在线实名认证服务。
限额是按模型算的,所以「选型」也是在选限额
硅基流动的限流有七种指标:RPM(每分钟请求)、RPH(每小时请求)、RPD(每天请求)、TPM(每分钟 token)、TPD(每天 token)、IPM(每分钟图片)、IPD(每天图片)。选模型时有三条机制必须先知道:
- 每个模型单独设置限额,一个模型超限不影响其他模型。这条对架构设计有直接影响——把负载拆到多个模型上,限额是独立算的。
- Rate Limit 定义在用户账户级别,不是 API key 维度。想靠多建几把 key 来放大限额是行不通的,这是很多人的第一反应,但方向错了。
- 七种指标中任一先达峰即触发,不是要全部达标。官方举的例子是:在同时有 RPM 与 TPM 限制的情况下,一分钟内发了达到 RPM 上限数量的小请求,即使 token 用量远没到 TPM 上限,限流照样触发。
收费模型的限额按账户用量级别分层,级别按月消费金额(含充值消费与赠送金额)划分,取「上月」与「当月 1 号至今」两者的最高值来换算,达标即自动升级、立即生效,新用户从最低档起步。具体每个模型的限额数值回模型广场查。触发 429 后官方推荐的处理是等待后重试并采用指数退避,跨厂商通用的机制展开见RPM 与 TPM 限流机制。
除了名字,选型时还要核这几个字段
模型清单确认完,真正决定调用是否顺利的往往是几个参数:
- max_tokens 与上下文长度相等。官方特别提醒,部分模型的推理服务在更新中,不要把 max_tokens 设为最大值,需要给输入内容留出余量,具体留多少以官方文档说明为准。这条反直觉的地方在于:max_tokens 调满不是「更保险」,而是更容易出问题。
- 输出乱码可以靠采样参数缓解。官方说明部分模型在不设参数时容易出现乱码,可以尝试设置
temperature、top_k、top_p、frequency_penalty。 - 输出被截断先查三处:max_tokens 设置是否合适;非流式的长输出容易触发 504 超时,改用流式;客户端的超时时间调大。第三方客户端方面,官方点名了 Cherry Studio 的默认 max_tokens 偏小,需要先打开「开启消息长度限制」开关才能调整。
- 服务端 503 / 504 是负载问题,官方给的处置是稍后再试,对话与 TTS 请求可以尝试改用流式输出。
专属实例用户:模型名要和实例对得上
如果你用的是专属实例,清单核对的重点又不一样。官方在 429 的排查说明里写着:专属实例用户通常无限额,出现 429 时先确认两件事——是否调用了专属实例的正确模型名,以及 api_key 是否与专属实例匹配。
也就是说,专属实例场景下的 429 大概率不是「你跑太快了」,而是请求根本没落到专属实例上,走了公共资源的限额。这个信号很容易被误读成需要扩容,实际只要把模型名和 key 对上就好了。
最后:把清单核对固化成一个顺序
与其每次遇到问题再翻文档,不如把这个顺序记下来,接新模型时走一遍:
- 到模型广场确认模型的准确名称,逐字符核对,尤其看开头有没有
Pro/; - 确认账户实名认证已完成——否则免费模型不是全都能用,403 也大概率由此而来;
- 确认这个名字对应的余额类型你有:官方就 DeepSeek R1 与 V3 说明过,
Pro/版仅支持充值余额,非 Pro 版赠费余额也能用(其他模型官方未逐一声明); - 在模型广场看这个模型的限额,并记住限额是账户级、按模型独立、七项任一触顶即触发;
- 参数上先把 max_tokens 留出输入余量,长输出直接上流式。
最容易栽的坑还是第一步和第三步之间的那个落差:模型名只差一个 Pro/ 前缀,却同时改变了限额规则和支付方式。清单查得再全,名字抄错一个字符,后面全是白排查。想横向理解不同平台在这件事上的做法差异,可以再看免费模型清单怎么查。
留言讨论
评论发布后会被人工复核,违规内容将被删除。
如果发表没有反应,可以前往联系我们告诉我们。