OpenRouter 免费吗?免费层与付费层的边界到底在哪

2026-08-31

数据截至 2026-08,价格与限额以各官网为准。本文只讲计费与接入机制,不列具体价格数字。

「OpenRouter 免费吗」这个问题之所以难答,是因为它其实是三个问题叠在一起:注册和用平台本身不要钱;平台上确实有一批标着免费的模型,用它们做推理不产生推理费;但只要你开始用付费模型,就要先往账户里存额度,而官方在你购买额度的时候会收一笔费用——按官方 FAQ 的说法,推理价格本身是原样透传上游供应商、不加价的,平台的收入来自这笔购买额度的费用。所以真正的分界不是「免费模型 vs 付费模型」,而是你有没有为额度付过钱。这一点在官方 API 里甚至有个专门的布尔位记录着。更麻烦的是,免费模型每天能发多少请求,本身又是按你累计购买过多少额度来分档的——想把免费层用得更宽,路径依然是付费。

先分清三层:账号、模型、平台费

官方 FAQ 的「Getting started」一节把上手流程写得很直白:创建账号,然后在 Credits 页面充值,额度就是你存在 OpenRouter 上的一笔预付款(原文的说法是 credits 就是存款),调用 API 或用网页聊天界面时,从这笔额度里扣掉请求的成本。

三层各自的收费情况是这样的:

  • 账号层:注册、拿 API key、看 Activity 用量、用网页聊天界面,官方文档里没有提到对这些动作单独收费。
  • 模型层:每个模型、每个供应商的百万 token 单价不同,提示词和补全通常是两个不同的价格,还有一部分模型是按请求计费、按图片计费或对推理 token 单独计费,这些都在模型页上标着。而标了免费的那一批模型,用它们做推理不产生这部分费用。
  • 平台层:官方明说购买额度时会收取一笔费用,加密货币支付另有一档费率。官方只说明了这笔费用在购买额度时产生、加密支付另有一档,至于它随什么变化,官方文档未展开。

把这三层拆开之后,「免费吗」的答案就清楚了:只用免费模型,可以做到全程不掏钱;一旦要碰付费模型,掏的钱是两笔——推理费加上购买额度时的那笔平台费。 具体费率官方指向定价页,本文不复述数字。想理解这笔钱怎么构成,可以配合读OpenRouter 计费机制那篇。

另外官方 FAQ 明确写着,OpenRouter 目前不提供批量折扣,认为自己属于特殊场景的可以发邮件沟通。所以别指望靠「充得多就便宜」来降低这部分成本。

免费模型有两个入口,行为不一样

官方给的免费模型用法有两条,别混着用。

第一条是 :free 变体后缀。 在模型 ID 后面直接追加 :free,比如请求体写成 "model": "meta-llama/llama-3.2-3b-instruct:free"。官方在模型变体那一节把 :free 归为静态变体,意思是它只能用在特定模型上,哪些模型有免费变体要去 models API 里查。文档对它的描述是:该模型始终免费提供,并且速率限制较低。

第二条是免费模型路由器 openrouter/free 把 model 字段直接填成 openrouter/free,它会从当前可用的免费模型里随机挑一个。官方描述的工作顺序是:先分析你的请求需要什么能力(比如图像理解、工具调用、结构化输出),再把可用免费模型过滤成支持这些能力的子集,然后从子集里随机选一个转发过去,响应里的 model 字段会告诉你实际用的是哪个模型。官方对这个路由器的定价说明是完全免费——路由器本身不收费,转发到免费模型的请求也不收费。

两者的取舍很明确:路由器省心但你控制不了具体用哪个模型,官方在 Limitations 一节直接把这条列为限制之一,并建议需要指定模型时改用 :free 后缀。官方同一节还列了另外三条限制:免费模型的速率限制可能低于付费模型;免费模型的可用性会变化,有些可能临时不可用;高峰期免费模型的延迟可能更高。注意这三条是官方文档自己的表述,不是实际调用出来的结论。

官方还专门加了一条警告:免费模型的可用列表变动频繁,要以模型页上按免费筛选出来的当前清单为准。这意味着把某个免费模型名硬编码进代码是有风险的;官方的措辞是可用性「可能」变动,至于某个模型不再提供免费变体之后请求会怎样,官方文档未作说明。

免费层的天花板:请求上限是按累计购买额度分档的

这是整件事里最反直觉的设计,也是「免费吗」这个问题真正的答案所在。

官方在 Limits 页把限制分成两类:额度限制管你能花多少钱,速率限制管你能发多少请求。免费模型撞的是后者。原文对免费用量限制的表述是:如果你用的是免费模型变体(ID 带免费后缀),会适用一张按「累计购买额度」分档的表,表的两列分别是每分钟请求数和每天请求数。FAQ 里换了个说法讲同一件事:免费模型的速率限制由你购买过的额度决定,购买额度达到门槛的账户,免费模型的每日请求上限更高;没达到的,每天只能发较少的免费模型请求。

注意这里的口径是累计(all time)购买额度,不是当前余额。这两个数在你花掉额度之后会分开走。

具体的门槛值和上限值本文不写。要用就去官方 Limits 页和定价页看当前值。

第二道限制是 Cloudflare 的 DDoS 防护,官方的表述是它会拦截显著超出合理用量的请求。这条不区分账户状态,也没有公开阈值。

还有一条容易踩的坑,官方在 Limits 页开头用提示框专门写了:多开账号或多建 API key 不会提高你的速率限制,因为容量是全局管控的。同一段紧接着给了官方认可的做法——不同模型有不同的速率限制,可以靠分散到多个模型来分摊负载。这两句是一体的,别只记住前半句。

第三条边界跟余额有关,而且它会打到免费模型头上:官方原文说,如果账户额度余额为负,你可能会看到错误,包括免费模型的请求也会受影响;把余额补到零以上就能重新使用这些模型。官方在这里用的是「可能」而不是「一定」,转述时这个不确定性得保留。它的实际含义是:免费模型不是完全独立于账户财务状态的一条通路,账户欠着钱的时候,免费这条退路也可能走不通。

关于限流触发之后怎么办,可以对照通用的 RPM/TPM 限流机制OpenRouter 429 的排查两篇一起看。

怎么确认自己现在在哪一层

不用猜,官方给了一个查询端点:对 https://openrouter.ai/api/v1/key 发 GET 请求,带上 Bearer 鉴权。官方给出的响应结构里,和「免费还是付费」直接相关的字段有这几个:

  • is_free_tier:官方对它的注释是「该用户此前是否购买过额度」。这个字段名和它的语义有点错位——它记的不是你这次调用用没用免费模型,而是这个账户的付费历史。注意官方并没有说明这个字段与免费模型请求上限的分档之间是什么关系,两者不要混为一谈;而且字段名与官方注释的方向看起来是相反的,官方也未进一步说明取值含义。
  • limit / limit_reset / limit_remaining:这三个字段描述的是单个 API key 上可选的消费上限,官方注释里写明 limit 为 null 表示不限,limit_reset 为 null 表示从不重置。这是账户余额之外的第二道额度闸——官方把额度限制的来源明确列成两处:账户余额,以及单 key 上的这个可选上限。
  • usageusage_dailyusage_weeklyusage_monthly:分别是全部历史、当前 UTC 日、当前 UTC 周(周一起算)、当前 UTC 月的额度消耗。注意这几个都是 UTC 口径,跟你本地的自然日不是一回事,做日报对账时容易对不上。
  • byok_usage 系列字段和 include_byok_in_limit:后者控制是否把外部自带 key 的用量算进这个额度上限里。
  • 响应里还有一个 rate_limit 对象,官方注释写的是已废弃、可以安全忽略。别去解析它。

官方在 Handling 402 errors 一节给的处理顺序也是围绕这几个字段:先充值把账户余额补到正数,再检查 key 上的 limit_remaining 是不是已经耗尽(耗尽了就提高该 key 的上限,或者等 limit_reset),最后建议主动定期调这个端点做提前监控,别等请求开始失败了才发现。这套做法本质上就是把成本监控前置。

顺带一个排查用的细节:官方在 Note 里写明,成功的推理响应里不带 X-RateLimit-*;只有当 OpenRouter 自己因为平台限制返回限流错误时,错误响应里才会带 X-RateLimit-LimitX-RateLimit-RemainingX-RateLimit-Reset 这三个头。另外,只有在所有尝试过的供应商都给出了重试提示的情况下,错误响应才会带 Retry-After 头。想在正常请求里读剩余配额是读不到的,要监控就得走上面那个 key 端点。

限流错误还有个来源问题:官方说它可能来自平台(撞了上面说的免费模型每分钟/每天上限或 DDoS 防护),也可能来自上游供应商在限流或满负荷。后一种情况下 error.metadata.provider_code 会带上供应商自己的错误码,而且 OpenRouter 的备用路由会先自动重试同一模型的其他供应商,之后才把错误抛给你。

四处容易被忽略的免费与付费边界

前面讲的是主线,下面这几条是官方文档里散落各处、但确实会影响「到底花不花钱」的判断。

联网搜索会额外收费,用免费模型也一样。 官方在网页搜索那节明确写了这一条:使用网页搜索会产生额外成本,即便配合免费模型也是如此。也就是说,模型免费不等于这次请求免费——你挂了服务端工具,费用就从别的口子出来了。

BYOK 的免费额度是按成本口径算的,不是按请求数。 官方 FAQ 里对自带供应商 key 这件事的表述是:BYOK 有一份随套餐而定的免费额度,这份额度以挂牌推理成本计量,而不是按请求数计量;超出免费额度的部分会按一定比例收费,这个比例是相对于「同样的模型和供应商在 OpenRouter 上正常需要花的钱」来算的,这笔费用从你的 OpenRouter 额度里扣。具体比例和各套餐的额度见官方定价页。这条的实际后果是:即便推理账单走的是你自己的供应商账户,OpenRouter 这边也不是零成本。

隐私设置对付费模型和免费模型是分开的两套。 官方在供应商日志那页写明,账户设置里可以选择是否允许路由到「可能用你的数据做训练」的供应商,而付费模型和免费模型各有各的设置项。这是很多人不知道的一条:你在付费模型上关掉了训练路由,不代表免费模型那边也关了。同一页还提到,如果你在请求里指定了供应商路由,但没有一个供应商满足你账户设置里的隐私级别,请求会直接报错、不会完成——所以这个开关拧太紧也会变成可用性问题。

允许记录提示词可以换取用量费用上的折扣。 官方 FAQ 说,默认不记录提示词和补全内容(即使出错也不记录),但提供一个可选开关,用户可以主动选择记录,以换取用量成本上的折扣。具体比例本文不写,以官方说明为准。这条属于「用数据换成本」的选项,值不值取决于你的内容敏感度,官方没有给建议。

结论与最容易栽的坑

回到最初的问题。如果你的用途是学习、试原型、做低频的个人项目,OpenRouter 官方在免费模型路由器的用例一节里列的正是这几种场景,走免费模型这条路是成立的,账号也不需要付过费。但官方同时留了一句很关键的评价:这些免费模型的速率限制很低,通常不适合生产使用。这句话是官方自己写的,不是外部评测。

最容易栽的坑有三个。一是把免费模型当成「和账户余额无关的安全垫」——余额为负的时候它也可能不好使。二是靠多开账号或多建 key 来绕免费层的请求上限,官方明说容量是全局管控的,这条路走不通,官方给的正解是把负载分散到限额不同的多个模型上。三是只看模型页的单价而忽略了购买额度时的平台费和联网搜索这类附加成本,导致估出来的月开销偏低。

下一步该做的其实很具体:先调一次 GET /api/v1/key,把 limit_remaining 记下来,心里有个数;再去模型页按免费筛一遍,确认你在用的那个免费模型现在还在名单里。想在免费模型里挑得更准,可以接着看OpenRouter 免费模型怎么选。以上机制均以官方文档当前版本为准,官方改了以官方为准。

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。

留言讨论

评论发布后会被人工复核,违规内容将被删除。

    还没有人评论,来说说你的看法

    如果发表没有反应,可以前往联系我们告诉我们。

    OpenRouter 充值不方便?

    国内直连的 OpenAI 兼容端点,一期提供 DeepSeek,注册送 ¥5。

    看替代方案

    这个页面有问题?

    提交时会附带当前页面地址和浏览器信息,帮助我们定位问题。不填联系方式即为匿名。