OpenRouter 额度怎么管才不超支?充值节奏、免费档限速与路由取舍

2026-07-27

数据截至 2026-07,价格与限额以各官网为准。

OpenRouter 官方明确说过不在模型价格上加价,但这不等于你花的钱就少——它真正的收费点在充值环节,而超支通常也不是从”模型太贵”开始的,而是从充值节奏没算清、免费档当成生产档用、以及对自动路由的成本口径没概念开始的。把这三件事分开管,账就好控制得多。

一个常见误解是:既然平台不加价,那用 OpenRouter 和直接找模型提供商买是一回事,随便充点钱试试就行。前半句在模型调用费这一项上确实成立,后半句会让你在小额充值上吃亏——因为手续费有一个最低值,充得越少,被最低值吃掉的比例越高。下面按”钱从哪儿出去”的顺序一项项拆。

先分清三笔钱,别混着算

在 OpenRouter 上,你的余额可能被三种方式消耗,性质完全不同:

第一笔是模型调用费。 这部分是透传的,官方在 FAQ 与定价页都写明:不对提供商价格加价,模型目录里显示的价格就是你实付的价格,与提供商官网上看到的一致。也就是说,这一项你能不能省,取决于你选了哪个模型、写了多长的 prompt,跟”用不用 OpenRouter”关系不大。

第二笔是充值手续费。 这才是 OpenRouter 自己的收入来源。按官方 FAQ 与定价页的说明:信用卡/借记卡(走 Stripe)充值收 5.5% 手续费,最低 $0.80;加密货币充值收 5%,没有最低限制。企业版走发票/采购单,具体条款需要和销售谈。

第三笔是 BYOK 平台费。 如果你已经有某家模型提供商的 key,想自带 key 走 OpenRouter 的统一接口,会另有一套规则,这一块下面单独说,因为官方两个页面的口径不完全一致。

把这三笔分开的意义在于:省第一笔靠选型和 prompt 工程,省第二笔靠充值节奏,省第三笔靠搞清楚规则边界。它们的优化手段互不相通,混在一起看只会得出”感觉有点贵”这种没法执行的结论。

充值节奏:被最低手续费和一年到期两头夹住

按官方给的费率做一下算术,就知道小额充值有多不划算。

信用卡渠道是 5.5% 且最低 $0.80。这意味着当充值金额小到某个程度,你付的其实是那个固定的 $0.80,而不是 5.5%。临界点大致落在十几美元这个量级——低于这个数,充得越少,实际费率越高。举个直观的例子:充 $10,5.5% 只有 $0.55,但要按最低 $0.80 收,实际费率变成 8%;而充 $100,就是老老实实的 5.5%。所以”先充 $5 试试水”这种做法,试水成本比你以为的高。

但另一头也别一次性充太多,因为 credits 有到期风险。官方 FAQ 的原话是保留在购买后满一年仍未使用时清零未用 credits 的权利。注意措辞是”保留权利”,不是”必然清零”,但既然写进了 FAQ,做预算时就该当成一个真实约束。促销赠送的免费 credits 到期规则可能更短,这一点以你账户内的实时提示为准,别照搬别人写的天数。

两头夹下来,合理的做法是:

  • 先用一两周的真实用量估出月消耗,再决定单次充值金额;
  • 单次充值尽量覆盖数月用量以摊薄手续费,但不要超过你有把握在一年内用完的量;
  • 如果你确实是长期稳定使用,加密货币渠道的 5% 且无最低限制,从纯费率看比卡渠道更省——但这只是费率对比,具体走哪条渠道还要看你自己的合规与结算要求,这篇不替你做决定。

免费档:能拿来干什么,不能拿来干什么

OpenRouter 提供了免费模型档,还有一个专门的免费路由(openrouter/free),会在可用的免费模型里做筛选/分配,官方页面上显示大约 26 个免费变体,多数来自 Qwen、DeepSeek、Llama、Gemma 这类开源模型的免费额度。

限速规则是明确的,也是这一档最需要记住的数字:

  • 没有购买过 credits 的账户:每天 50 次、每分钟 20 次;
  • 历史充值累计达到 $10 的账户:每天 1000 次,每分钟 20 次的限制仍然存在。

这组数字决定了免费档的适用边界。每分钟 20 次的上限意味着任何有并发的场景都会立刻撞墙——不管你是每天 50 次还是 1000 次,RPM 都卡在同一个位置。所以免费档适合:写 demo、跑通接口、比较几个模型的输出风格、做低频的个人小工具。不适合:面向用户的线上服务、批量数据处理、任何有突发流量的场景。官方也不建议把免费模型用于生产环境(这句表述出自第三方引用,未在官方原文逐字核实,但从限速数字本身就能推出同样的结论)。

还有一个容易被忽略的连带效应:只要你充值过 $10,免费档的每日额度就从 50 涨到 1000。也就是说,第一笔充值除了买 credits,还顺带解锁了免费档的更高日限。做预算时可以把这一点考虑进去。

自动路由和 fallback:省心,但要知道成本口径

OpenRouter 的一个核心卖点是自动处理故障转移。按官方 FAQ 的说法:某个提供商返回错误时,OpenRouter 会自动切换到下一个提供商,这个过程对调用方是透明的,能让生产应用更有韧性。同时官方还有一项被称为 Zero Completion Insurance 的机制——失败的请求不计费,只按成功的请求收钱。

这两件事对成本管理有两层含义。

好的一面:你不用为重试逻辑单独写一层容错代码,也不用担心为一堆失败请求付钱。这在多模型混用的场景下省的不只是钱,还有工程时间。

需要留意的一面:既然是自动切换提供商,同一个模型在不同时刻可能由不同的提供商承接。你在做成本预估时,最好不要把某一次账单的单价当成永远成立的常数,而是以 openrouter.ai 模型页的实时价格和你自己的账单明细为准去核对。至于是否可以对路由行为做更细的干预、有哪些参数可用,以官方文档当前页面的说明为准,别照抄网上几个月前的教程里的参数名——这类接口细节变动比价格还快。

模型选型是最大的那个变量

前面几节都是几个百分点的账,真正能拉开数量级差距的还是选哪个模型。以官方模型页在 2026-07 核实到的三个代表性型号为例(单位:美元 / 百万 token):

模型输入价输出价上下文窗口
OpenAI GPT-5.5$5$301M
Anthropic Claude Opus 4.7$5$251M
Google Gemini 2.5 Pro$1.25$101M

其余模型的价格请以 openrouter.ai/models 的实时页面为准,这里只列了逐一核实过的三个。

按这张表做个粗算:假设一个应用每天 1000 次请求,平均每次输入 2000 token、输出 500 token,那么一天消耗输入 200 万 token、输出 50 万 token。用 GPT-5.5 大约是 $10 + $15 = $25/天;换成 Gemini 2.5 Pro 大约是 $2.5 + $5 = $7.5/天。同样的流量,月成本差出三倍多。这个算术是按上表单价推的示意,你自己的 token 结构不同,结论会不同,但量级关系说明了一件事:在模型之间做选型,比在充值渠道上省那半个百分点的手续费重要得多。

另外注意输出价通常显著高于输入价(表里三个都是这样)。所以控制输出长度——设合理的 max tokens、让模型别啰嗦、结构化输出而不是长篇散文——往往比压缩输入更立竿见影。

BYOK:规则边界要自己去核

如果你已经有 OpenAI、Anthropic 之类的官方 key,想自带 key 走 OpenRouter,规则需要特别小心,因为官方两个页面的表述口径不同:

  • FAQ 页是按请求次数说的:首月 1M 次 BYOK 请求免费,超出后按该模型/提供商正常价格的 5% 收平台费;
  • 定价页是按金额说的:Pay-as-you-go 每月在 $25,000 等值的 list price 推理额度内免手续费,超出部分收 5%;Enterprise 版这个额度是每月 $200,000,超出同样 5%。

一个是”请求次数”,一个是”金额”,两者的关系官方页面上没有说清楚,很可能是不同时期的表述遗留。这里如实标注:未能核实两者的一致性。如果 BYOK 的费用会影响你的决策,请直接去 openrouter.ai/docs/faq 和 openrouter.ai/pricing 看当前页面,或者直接问官方支持,不要拿这篇(或任何第三方文章)里的数字去做预算承诺。

一份不超支的操作清单

把上面的内容压成可执行的动作:

  1. 先跑两周再定充值额。 用免费档或小额 credits 摸清真实 token 结构(输入/输出比例、日请求量),再算月消耗。
  2. 单次充值别太小。 卡渠道有 $0.80 的最低手续费,充几美元时实际费率会明显高于名义的 5.5%。
  3. 也别一次充满一年以上的量。 官方保留一年未使用清零的权利。
  4. 免费档只用于开发和评测。 每分钟 20 次的上限决定了它上不了生产。
  5. 优先在模型选型上省钱。 同样流量换个模型可能差好几倍,比抠手续费有效得多。
  6. 重点压输出长度。 输出单价普遍高于输入,设 max tokens、要求结构化返回都是直接见效的手段。
  7. 模型 ID 记得带命名空间前缀。 OpenRouter 的模型名形如 openai/xxxanthropic/xxxgoogle/xxx,漏了前缀会直接调不通。
  8. 定期回账单核价。 提供商调价、自动 fallback 换承接方,都可能让实际单价和你记忆里的不一样。
  9. 单个 key 能不能设消费上限,以控制台当前页面为准。 通用的稳妥做法是开发、测试、生产各用一把 key,出问题能单独吊销,而不是全盘更换。

顺带说一句请求头:官方文档里的 HTTP-RefererX-Title 两个头都标注为可选,用途是 openrouter.ai 的站点排行榜统计,不传不影响调用。别把它们误当成账单分账的工具。

中国大陆访问的现实情况

这一节和额度管理没关系,但绕不过去。OpenRouter 是境外托管的服务,官网及其 API 在中国大陆网络环境下普遍需要通过网络代理才能稳定访问——这是同类海外 AI 聚合平台(以及它底层依赖的那些海外模型服务)的共性情况,不是 OpenRouter 独有的。

需要诚实说明的是:不应该认为官方支持大陆直接访问。 市面上确实存在第三方中转、镜像类服务声称提供国内可直连的转发,这篇不推荐、不背书任何具体渠道——这类服务的合规性、稳定性和数据安全性无法从官方信息核实,且变动很快。如果确实需要在大陆稳定使用,比较务实的方向是评估企业出海的合规网络方案,或者直接咨询国内可合规触达的服务商。另外,OpenRouter 官网并未就”中国大陆访问政策”给出正式声明,以上是可用性层面的现实描述,具体以官网和官方条款为准。

小结

OpenRouter 的账分三块:透传的模型调用费、充值环节的手续费、BYOK 的平台费,优化手段各不相同,不要混着算。充值节奏被两头夹住——下有最低 $0.80 的手续费不鼓励小额试水,上有一年未用可能清零的规则不鼓励囤太多,中间那个区间要靠你自己的真实用量算出来。免费档的每分钟 20 次上限决定了它只能是开发和评测工具,不是生产方案。真正决定月账单量级的还是模型选型和输出长度控制,比抠手续费有价值得多。最后,BYOK 的两处官方口径尚不一致,价格与政策也会变动,任何要写进预算的数字都请回官网当前页面重新核一遍。

接下来看什么

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。