编程 Agent 额度在最要紧的时候用完了怎么办?一份应急预案

2026-08-08

周四晚上十一点,功能还差最后一块没接上,你敲下一句”把这个模块的错误处理补完”,回来的是一行红字:本周期用量已用完。

这时候最容易做的两件事,恰好都是错的:一是打开五个标签页开始比价,二是干坐着刷新页面看额度会不会自己回来。前者浪费的是你最贵的一小时,后者浪费的是整晚。

这篇文章只解决一个很窄的场景:你已经撞限了,现在要在最短时间内让活继续往下走。不讨论怎么选工具、不讨论哪家更划算——那些是平时该想的事,现在没时间想。读完你应该能在三分钟内判断出自己有几张牌可打,并且立刻开始打。

第一步永远是:先搞清楚你这家属于哪一种

撞限之后所有人都会问”怎么办”,但”怎么办”没有统一答案,因为不同工具的额度用完,代价落的地方根本不一样。有的落在钱上,有的落在时间上,有的两样都不给你选。

按”你还剩什么手段”分,一共就三类:

类型撞限后你能做什么代表机制恢复速度
能加钱的掏钱买超额用量,立刻继续Kiro 按 $0.04/credit 继续买;Warp 可购买额外额度并支持自动充值 auto-reload;Devin 可额外购买用量、按 API pricing 计费;Augment 的 “Top-ups, pay as you go”分钟级,甚至无需手动操作
能降速继续的不花钱,接受排队Cursor 快速请求用完后降到慢速池,功能不变但要排队立刻可用,但每次都要等
只能等的钱通常解决不了当下这一刻Claude Code 是滚动时间窗口,外面还套着更长周期的限制等窗口自己滚过去

这张表值得你现在就看一眼自己在用的那家落在哪一行。不知道自己属于哪种,就会在最该干活的时候乱试——去付费页面找”立即续费”结果发现根本没有这个按钮,或者反过来,明明花二十美元就能马上恢复,却花了四十分钟在论坛里翻别人什么时候恢复的。

我把 Warp 的自动充值单独拎出来说一句:它是这三类里唯一可能让你根本不会撞限的机制——余额见底时自动补上,你甚至察觉不到。代价当然是账单不再由你逐次确认,这个开关平时可以关着,deadline 那几天可以打开。

三类各自的应急动作

能加钱的:现在算一笔账,三十秒之内做完

这类最舒服,但也最容易在两个地方犯错:一是纠结,二是补完就忘。

先说算账。你面临的选择只有两个:补超额,还是直接升档。判断标准是一条分界线:

分界线 =(下一档价 − 当前档价)÷ 超额单价

拿 Kiro 举例。它 $20 档含 1,000 credits,摊下来是 $0.02/credit;超额单价是 $0.04/credit,正好是套餐内的两倍。下一档 $40 含 2,000 credits。代入公式:

($40 − $20)÷ $0.04/credit = 500 credits

也就是说,这个月你预计还要多用 500 credits 以内,补超额更省;超过 500,直接升到 $40 档更省。这个数不难验证:补 500 credits 的超额要花 500 × $0.04 = $20,而升档也是多花 $20,但升档给的是整整 1,000 credits 的增量。超过 500 之后,升档就是纯赚。

同一条公式套到别的档位一样成立,你只要把两个价格和超额单价换掉。Kiro 各档位(PRO $20/1,000、PRO+ $40/2,000、PRO MAX $100/5,000、POWER $200/10,000)的超额单价都是 $0.04/credit,所以相邻档之间的分界线你自己就能算。

然后是两句提醒,分量比公式还重:

别在 deadline 前纠结这几十美元。 你卡在那里权衡二十美元和四十美元的那半小时,成本远高于差价本身。当下的唯一目标是让活继续走,先补上,账后面再算。

但也别忘了事后把档位调回来。 应急升上去的档位如果没人管,它会安安静静地每月扣下去。我见过太多人第二个月才在账单里发现自己还挂在应急那天升上去的档。补完超额、交完活,把这件事写进你的待办里。

这里必须诚实说一句:Devin 这类”按 API pricing 计费”的超额,成本是算不准的。它的官方定价页写明超出部分可以额外购买、按 API 价格消耗,但同一句话没有给出换算关系,所以我没法告诉你”多花 X 美元能换来多少活”。它另外还有一层机制值得注意——用量额度是按日、按周自动刷新的。这两条都以官方定价页为准,我不替它编数字。

能降速继续的:接受变慢,同时把工作方式改成”少而准”

Cursor 属于这一类:快速请求用完之后不是断供,而是降级到慢速池,功能不变,但每次请求都要排队(这条机制在Cursor 快速请求用完了怎么办里讲得更细,具体等多久取决于当时的负载,我不给你一个假的秒数)。

不花钱就能继续,这是好事。但很多人在慢速池里的实际效率反而比撞限前更低,原因是他们的提问方式没变

平时不排队,你可以随手扔一句”帮我看看这里为什么不对”,错了再问一次,两轮三轮无所谓。进了慢速池,每一次调用都要排队,试错的单价从几秒钟涨到了几分钟,原来的打法就不成立了。

所以慢速池里的正确姿势是:把需求圈死再发,减少 Agent 自主展开的步数。

  • 别发:「帮我优化下这个项目」——它会自己拆成搜索、读取、生成、逐文件改、自检十几步,每一步都在排队。
  • 要发:「只改 order/service.ts 里的 createOrder,加上参数校验,别动支付逻辑,改完把 diff 给我」——一步到位,排一次队。

同样的道理:把三个小修改攒成一次请求发出去,比分三次发划算得多。排队的成本是按”次”收的,不是按”改动量”收的。

只能等的:立刻切换工作方式,而不是干等

Claude Code 走的是滚动时间窗口的路子,窗口之外还套着更长周期的限制(见Claude Code 额度限制Claude Code 周限制)。这类机制的特点是:当下这一刻,钱通常解决不了问题,你只能等窗口滚过去

但”只能等”不等于”只能闲着”。这是本文最实用的一节,单独展开讲。

等待期间怎么不浪费时间

思路只有一条:把需要 Agent 的活和不需要 Agent 的活分开,先干后者

你手上剩下的任务里,至少有一半根本不需要 Agent,甚至自己动手更快:

  • 写测试。你比 Agent 更清楚这个函数哪里容易出问题、边界在哪。
  • 理清需求。把”这个功能到底要做成什么样”想明白,本来就不该外包。
  • 画数据结构。表结构、接口字段、状态流转,纸上画十分钟能省后面两小时。
  • 读代码。要改的那几个文件你自己通读一遍,等窗口恢复时你会知道该让它动哪里、不该动哪里。
  • 写文档、做 code review。这两件事本来就是人干得更好的。

然后是关键的一步:把要交给 Agent 的任务在等待期间写清楚

不是记个大概,是逐条写成可以直接粘贴的指令:改哪个文件、哪个函数、期望的行为是什么、明确不要动什么、改完要怎么验证。窗口一恢复,你把攒好的三四条一次性发出去,命中率高、返工少。

这一步的收益是双份的:不浪费额度(一次到位,不用来回澄清),也不浪费时间(恢复的那一刻你就在跑,而不是从头想)。等待期本来是纯损失,这么一转,它变成了你平时最容易跳过的那部分准备工作。

准备一个备选出口

这条是事前功课,但必须写在这里,因为它是唯一能把”撞限”从灾难降级成小插曲的东西。

提前知道自己撞限时能切到哪:另一个工具、另一个账号形态、或者干脆手写。不用真的买,知道切到哪即可。 花十分钟想清楚”如果 A 停了我今晚用什么”,比撞限当晚花一小时比价强得多。

真正决定切换成本的,其实不是你有没有第二个账号,而是你的提示词和项目约定放在哪里

如果这些东西躺在某个工具的云端设置里——它的自定义指令面板、它的项目记忆、它的规则库——那你换工具的时候等于从零开始,光是把”这个项目用什么风格、哪些目录不能碰、提交信息什么格式”重新说一遍就要半小时。

把它们放进自己的仓库里,一个纯文本文件,跟代码一起版本管理。这样切换成本才低:换一家工具,把文件内容贴过去就行。这件事和额度没关系,但它决定了你撞限那天有没有退路。

事后复盘三件事

活交完了,别急着翻篇,问自己三个问题:

一、这次是偶发,还是每个月都会发生? 偶发就当交学费,不用改什么。如果连着两三个月都在月底撞限,那不是运气问题——你的档位和你的用量不匹配了

二、如果每月都超,就该按分界线升档,而不是每次应急。 回到上面那条公式。每月固定超 800 credits 的人,用超额补要多花 800 × $0.04 = $32;升一档只多花 $20,还多给 1,000 credits 的额度空间。每月应急一次,一年就是十二次心跳加速加十二笔溢价,这笔账不用算第二遍。

三、用量高是因为活多,还是因为提问太发散? 这个问题最容易被跳过,但往往是真正的原因。

对比一下这两句:

  • 「帮我优化下这个项目」——Agent 会自己拆成搜索、读取、生成、逐文件修改、自检十几步,绝大部分步骤跟你真正想改的那个函数没关系。
  • 「只改 order/service.ts 里的 createOrder,别动支付逻辑」——收敛得多,一两步就到位。

同样一件事,前者的消耗可能是后者的好几倍。如果你复盘下来发现自己大部分请求都是第一种,那升档只是把问题往后推一个月,真正该改的是提问方式。这也是我一直觉得比”哪家更便宜”更值得花时间的地方:提问方式带来的用量差异,往往比不同工具之间的定价差异更大

一条事前预防:deadline 前几天开始盯余额

最后一条,成本几乎为零,收益最大。

deadline 前几天就开始看余额,别到当天才发现。 提前三天知道额度只剩三分之一,你有的是从容的选择:调整任务顺序、提前补额度、把最吃额度的重构挪到窗口刷新之后。当天才发现,你就只剩应急一条路。

尤其要提醒用按日、按周自动刷新这类机制的人(Devin 的定价页就写明它的用量额度是这么刷新的):额度攒不住。你不能指望”这周先少用点,攒到周末冲刺一把”——刷新周期一到,没用完的部分不会跟着你走。这意味着集中冲刺这条路本来就走不通,必须提前把任务摊到多天,每天用掉一部分。这是机制决定的,跟你多努力没关系。

最后

撞限当下真正值钱的不是钱,是判断力。

先认清自己属于哪一类——能加钱的、能降速继续的、只能等的。能加钱的,用分界线公式三十秒做完决策,别纠结,但记得事后调回来;能降速的,接受变慢并且把提问改成”少而准”;只能等的,立刻切到不需要 Agent 的活,同时把恢复后要发的指令写清楚。

这三条动作加起来不到五分钟,但它们的区别,就是”今晚交得出去”和”今晚废了”的区别。至于哪家的额度机制更适合你,那是明天早上该想的事。

相关阅读

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。