Gemini CLI 每分钟 60 次够用吗?分钟限流才是真正卡你的那条线

2026-08-08

看 Gemini CLI 的额度表时,绝大多数人的注意力都在「每天多少次」上。

但实际用起来,先撞墙的往往是另一条线——每分钟的上限。这条线在表格里很不起眼,却决定了你能不能舒服地跑一个多步骤任务。

一、两条线,独立生效

按官方额度与定价页:

授权方式每日请求上限每分钟请求上限
Google 登录(Gemini Code Assist 个人版)100060
Gemini API Key(未付费)25010
Gemini Code Assist 标准版1500120
Gemini Code Assist 企业版2000120

单位都是 model request(模型请求次数)。

关键在于这两条线是各自独立生效的——不是「每天 1000 次,你随便怎么用完」,而是「每天不超过 1000,且任意一分钟内不超过 60」。

二、60 次/分钟到底是什么概念

平均下来是一秒一次。听起来非常宽裕——你哪有可能一秒敲一次回车。

但这条线不是按你敲回车的频率算的,是按实际发出的模型请求算的。

而在 CLI 里干一件事,模型往往要来回好几轮:理解需求、读文件、决定改什么、动手改、验证结果。你感觉自己只提了一个需求,后台可能已经走掉好几次请求了。

一次对话到底等于几次请求?官方页面没有给这个换算关系。 所以本文不给数字——任何「一轮对话约等于 N 次请求」的说法都是编的

但可以给一个定性的判断:请求是密集发生的。你提一个需求之后的那几十秒里,它可能连续发出好几次;然后你思考、看结果、敲下一个需求,这段时间一次都不发。

也就是说,请求的分布是脉冲式的,不是均匀的。 而分钟限制卡的正是脉冲的高度。

三、什么场景最容易撞

按脉冲的高度排序,从最容易撞到最不容易:

最容易:让它自主跑多步骤任务。 这是脉冲最高的场景——它在几十秒里连续读文件、连续改、连续验证,中间不需要你介入。任务越自主,请求越密集。

很容易:同时开几个会话干活。 两个会话各自的脉冲叠加,高度直接翻倍。三个就三倍。这是最容易被忽略的一种——你觉得自己没用多少,但额度是按账号算的。

容易:脚本里循环调用。 循环没有人类的思考间隙,密度取决于代码怎么写的。

不容易:一问一答式使用。 你提一个问题,看结果,思考,再提下一个。中间的思考时间天然拉开了间隔。

判断自己属于哪种,比记住 60 这个数字更有用。

四、日限和分钟限,你会先撞哪条

这决定了你该不该升级、以及升级有没有用。

先撞分钟限的人:集中作战型。比如晚上抽两小时集中干一个项目,期间高强度使用。总量可能远没到 1000,但那两小时里的某几分钟密度很高。

先撞日限的人:细水长流型。一整天断断续续在用,每次都不密集,但累积起来量很大。

两条都撞的人:既长又密。这种情况下升级的收益最明显。

怎么知道自己是哪种:看你撞限的时机。

  • 刚猛干了一阵子突然被拦,等一会儿又能用 → 分钟限
  • 一整天用下来,到下午或晚上开始持续被拦 → 日限

这两种的报错都是 429:

API Error: got status: 429 Too Many Requests.

(GitHub 上 issue #1502 记录的就是这条。)报错文本本身不区分是哪条线,得靠上面的时机判断。

五、升级的收益不对称

这是本文最实用的一节。看这两档的对比:

个人版标准版涨幅
每日10001500+50%
每分钟60120翻倍

升级对两条线的收益完全不同。

  • 如果你撞的是分钟限 → 升级把上限翻倍,收益明显
  • 如果你撞的是日限 → 只涨 50%,收益有限

再看标准版和企业版:

标准版企业版
每日15002000
每分钟120120

每分钟完全一样。 也就是说,如果你的瓶颈是频率,从标准版升到企业版对你没有任何帮助——你多花的钱只买到了每日额度从 1500 到 2000。

这个不对称是选档时最该看清的一点。 先搞清楚自己撞哪条线,再决定升不升、升到哪一档。

(关于这两个付费档的价格:官方额度页上没有给金额,只有请求数上限。所以本文不给任何价格数字,需要的话请查官方定价页。)

六、免费的两条路差六倍

免费档里,Google 登录和免费 API Key 的分钟限差距是 60 对 10——六倍

每分钟 10 次意味着平均六秒一次。 一个自主跑的多步骤任务,很容易在头几十秒里就撞线。实际体验就是干着干着突然被拦。

所以如果你在用免费 API key 那条路,而且经常撞 429,先确认一下能不能改用 Google 登录——这是成本为零、收益六倍的一次改动。

有些人是因为登录报错才退到 API key 的(比如「必须是组织订阅的具名用户」那条,真因通常是环境里有 GOOGLE_CLOUD_PROJECT 变量)。那类报错有官方解法,修好它比忍受六分之一的频率划算得多。

七、撞上分钟限怎么缓解

如果暂时不升级,有几个能立刻用的做法:

把大任务拆开。 一次让它干三步,而不是三十步。脉冲高度降下来,就不容易撞了。

别同时开多个会话。 尤其别在跑着一个自主任务的时候,再开一个会话干别的。

撞了就等一分钟。 分钟限是滚动的,等一分钟窗口就滑过去了。别在被拦的时候疯狂重试——重试也算请求,只会让窗口一直填满。

脚本里加间隔。 如果是自动化调用,主动控制节奏比撞了再退避更平稳。

观察自己的脉冲。 干一个典型任务,留意从提需求到出结果这段时间有多长、期间大概发了多少次请求。这个观察值比任何通用建议都准。

八、总结

  • 每日和每分钟是两条独立的线,很多人先撞的是分钟那条。
  • 60 次/分钟不是按你敲回车的频率算的,是按实际模型请求算的,而请求是脉冲式发生的。
  • 最容易撞的场景:让它自主跑多步骤任务、同时开多个会话、脚本循环。
  • 判断自己撞哪条:猛干一阵突然被拦 → 分钟限;用一整天后持续被拦 → 日限。
  • 升级的收益不对称:个人版升标准版,分钟限翻倍、日限只涨 50%;标准版升企业版,分钟限完全没变
  • 免费的两条路差六倍(60 对 10),能用 Google 登录就别退到 API key。
  • 被拦时别疯狂重试——重试也占额度,会让窗口一直是满的。

本文数字来自 Gemini CLI 官方额度与定价页,issue 编号来自 google-gemini/gemini-cli 仓库,核对日 2026-08-08。付费档的价格官方该页未给出,本文不提供。额度政策会调整,以官方页面为准。

相关阅读

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。