OpenRouter 的免费模型能用到什么程度?限速、模型池与适用边界

2026-07-28

数据截至 2026-07,价格与限额以各官网为准。

OpenRouter 的免费档不是”缩水版付费档”,而是一个额度很紧、模型池以开源模型为主的试用通道:没充过值的账号每天只有几十次调用,每分钟也有并发上限,官方定位里它就不是给生产环境用的。把它当成学接口、跑 demo、做一次性小批量实验的工具,你会觉得挺好用;把它当成给真实用户提供服务的后端,第一天就会被限速打回来。

一个常见误解:免费档是”能力被削弱的同一批模型”

很多人第一次点进免费模型列表,会以为这是把付费的那些旗舰模型降智之后放出来的版本,于是纠结”免费的 GPT 是不是笨一点”。这个理解方向不对。

免费档里的模型,大多是本身就开源、可以自由部署的那一类——Qwen、DeepSeek、Llama、Gemma 这些系列的变体占了主体。它们不是被削弱的闭源旗舰,而是另一批模型;模型权重本身跟你自己在服务器上跑的是同一套,区别只在于这里有人替你托管、并且暂时不收你的钱。官方在免费路由页上展示的免费变体数量大约在二十几个这个量级,具体有哪些型号、还剩几个可用,会随提供方的赞助额度和政策变动而变,以模型列表页当时显示的为准。

所以正确的心理预期是:免费档的上限,基本等于当下开源模型的上限,而不是”打折版的闭源旗舰”。如果你的任务本来就是开源模型能干的(分类、抽取、改写、简单问答),免费档给出的质量不会因为免费而缩水;如果你的任务必须靠闭源旗舰的长上下文和复杂推理才能完成,免费档里本来就没有那张牌。

限速才是真正的天花板

免费档最硬的约束不是质量,是频次。官方文档和定价页给出的规则是分两档的:

  • 从没充过值的账号:每天 50 次请求,每分钟 20 次。
  • 账户历史累计充值达到 10 美元以上:每天上限提到 1000 次,但每分钟 20 次这条并发限制仍然在。

这两个数字值得掰开算一下体感。每天 50 次是什么概念?你写一个脚本调试提示词,一轮改几个字重跑一次,一个下午就能烧完。而每分钟 20 次意味着并发能力极低——只要你写了个 for 循环批量跑几百条数据,不加节流的话几秒钟就会撞上限速返回错误。

而升到每天 1000 次的门槛,注意措辞是”账户历史充值达到 10 美元”,不是”当前余额有 10 美元”。也就是说这是一次性的资格解锁:你充过这笔钱,即使后来余额花光了,免费档的高额度资格通常仍然保留(具体判定以官方当前说明为准)。这条规则的实际含义是,OpenRouter 用一个很低的门槛把”真实开发者”和”纯薅羊毛账号”分开了。

顺带说一句充值这笔钱的账:信用卡充值走的是 5.5% 的手续费且有 0.80 美元的最低收费,加密货币充值是 5%、没有最低限制。按规则取高者算,充 10 美元这种小额充值,手续费实际会落在最低那一档上——比例上看不便宜,但作为解锁 1000 次/天的一次性成本,它跟你之后省下的调试时间比通常不算贵。另外记得官方保留”购买满一年未使用的 credits 可以清零”的权利,所以别一次充一大笔然后放着不用。

哪些场景免费档真的够用

把限速摊开之后,适用边界就清楚了。下面这几类我认为是免费档能踏实干的:

学接口、跑通第一个请求。 OpenRouter 是 OpenAI 兼容的,base URL 填 https://openrouter.ai/api/v1,你完全可以直接用 openai 这个 Python 包,把 base_url 一改就能发请求,模型名写成带命名空间前缀的形式(像 openai/xxxanthropic/xxxgoogle/xxx 这种)。免费档在这个阶段完全够——你要验证的是”请求能不能发出去、返回结构长什么样”,一天 50 次绰绰有余。

做模型横向对比的第一轮粗筛。 同一个提示词,换几个不同厂商的模型跑一遍看效果差异,这种事免费档很合适,因为你需要的是”多样性”而不是”高频次”。跑完粗筛心里有数了,再决定把预算花在哪个模型上。

低频的个人自用小工具。 比如一个每天手动点几次的翻译脚本、一个偶尔用来整理笔记的命令行工具。这类用法一天调用次数是个位数到十几次,免费档完全托得住。

一次性的小批量离线任务。 几百条数据的清洗、打标,只要你在代码里加了节流(比如每次请求之间 sleep 几秒),配合每天 1000 次的额度,分两三天跑完是可行的。关键是必须自己写限流逻辑,别指望平台替你排队。

哪些场景必须换付费档

反过来,下面这几种情况我建议直接别在免费档上浪费时间:

对外提供服务的任何后端。 只要你的接口是给真实用户调的,用户数一上来,每分钟 20 次这条线随时会被击穿,而且是在你最不希望它挂掉的时候挂掉。官方的定位表述里,免费模型也不是面向生产用途的(这句定位在第三方转述里流传较广,具体措辞以官方当前页面为准)。

需要稳定 SLA 和可预期延迟的场景。 免费额度背后往往是提供方赞助的算力池,排队情况和可用性不由你控制,今天顺畅不代表明天顺畅。

依赖特定闭源旗舰能力的任务。 前面说过,免费池里主体是开源模型。你要 1M 上下文窗口那种规格,就得走付费档。参考一下付费档的价格量级:官方模型页上 Gemini 2.5 Pro 是每百万 token 输入 1.25 美元、输出 10 美元,Claude Opus 4.7 是 5 美元和 25 美元,GPT-5.5 是 5 美元和 30 美元。对个人开发者做个小项目而言,付费档并没有想象中那么烧钱——真正贵的是你为了省这几块钱去跟限速搏斗的时间。

免费档要注意的几个坑

别把 fallback 当免费的保险。 OpenRouter 有自动故障转移机制,某个提供商报错时会透明地切到下一个可用提供商,官方也说过失败的请求不计费。但要意识到:如果你的请求最终被路由到了付费提供商那里,那这次调用就是要扣余额的。用免费模型时要留意自己请求里指定的到底是哪一档,别以为选了免费路由就一定不会产生费用。

限速返回的错误要有重试逻辑。 撞上每分钟 20 次的墙时,你的脚本会拿到错误响应而不是结果。写批量任务时最起码要加上退避重试,否则一批数据跑一半崩掉,前面的结果还没落盘就白跑了。

免费模型池会变。 今天能用的某个免费变体,下个月可能就下线或者改成付费了。所以别把某个具体的免费模型名字硬编码进关键流程里,至少留一个可配置的开关。

可选请求头可以不填。 文档里的 HTTP-RefererX-Title 两个头都标注为可选,作用是站点排行榜统计,不填不影响调用。有些教程写得像必填项,照抄反而容易困惑。

大陆访问这个前提得先解决

这一节跟代码没关系,但比代码重要。OpenRouter 是境外托管的服务,官网和 API 端点都在海外,它背后依赖的 OpenAI、Anthropic、Google 等厂商官方也并未把中国大陆列为受支持地区,注册、控制台与 API 端点都在境外。这是同类海外聚合平台的共性现实,不是 OpenRouter 独有的问题。

所以在大陆网络环境下,直连能不能通、通了稳不稳定,这件事得你自己先验证清楚,再谈免费额度够不够用。本文不提供也不背书任何第三方中转渠道——市面上确实存在这类转发服务,但它们的合规性、计费透明度和数据安全性无法从官方信息核实,风险由使用者自负。具体的地区政策以各厂商官网当前页面为准。

如果你需要的是在国内能稳定跑起来的免费额度,方向其实应该反过来:去看国内厂商自己提供的免费档,那条路在准入层面没有这些问题。

小结

免费档的价值在于”零成本试错”,不在于”省下服务器钱”。没充过值时每天 50 次、每分钟 20 次,充过 10 美元后每天提到 1000 次但并发限制不变,这组数字基本框定了它的使用场景:学习、粗筛、低频自用、小批量离线任务。免费池里主要是开源模型的托管变体,质量上限跟当下开源模型持平,不是打折版闭源旗舰。凡是对外服务、需要稳定性、或者必须依赖闭源旗舰能力的,老老实实走付费档,成本通常比你担心的低。最后,大陆访问这个前提要在写第一行代码之前就确认好,别等接口调通了才发现整条路走不通。

接下来看什么

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。