Gemini CLI 额度怎么算?四档请求上限、双重限流与「一次请求」的真实含义

2026-08-08

用 Gemini CLI 之前,多数人只想知道一件事:免费能用多少,够不够我一天干活。

官方给的数字其实很清楚,但有两个地方特别容易理解错,一错就会把预算估反:一是额度单位不是 token,二是限流有两条线,而且经常是你没预料到的那条先撞。这篇把账摆清楚,同时诚实标出哪些数字官方给了、哪些没给。

一、四档官方数字

按官方额度与定价页,登录方式决定你落在哪一档:

授权方式每日请求上限每分钟请求上限
Google 登录(Gemini Code Assist 个人版)1000 model requests / user / day60 / user / minute
Gemini API Key(未付费)250 model requests / user / day10 / user / minute
Gemini Code Assist 标准版1500 / user / day120 / user / minute
Gemini Code Assist 企业版2000 / user / day120 / user / minute

另外 Vertex AI 的 Express Mode 官方写的是 90 天,之后需要启用付费。Vertex AI 和 Gemini API Key 都支持按实际使用的模型与 token 数付费,但具体单价那个页面没给,要去各自的定价页查。

先说三个从这张表能直接读出来的结论:

  1. 用 Google 账号登录,比用免费 API key 划算得多——每日 1000 对 250,每分钟 60 对 10。差的不是一点。
  2. 标准版和企业版的差距只在每日额度(1500 vs 2000),每分钟都是 120。如果你的瓶颈是频率而不是总量,这两档对你没区别。
  3. 付费档的价格,这个页面没写。 只有请求数上限,没有金额。所以本文不给任何 Gemini Code Assist 付费档的价格数字——不是漏了,是官方那页确实没有,编一个出来对你没好处。

二、单位陷阱:model request 不是 token,也不是「一句话」

这是最容易把预算估错的地方。

额度单位写的是 model request——模型请求次数。它既不是 token 数,也不等于你敲了几次回车。

为什么这个区别要命?因为在 CLI 里干一件稍微复杂点的事,模型往往要来回好几轮:读文件是一次、想清楚怎么改是一次、动手改是一次、验证结果又是一次。你感觉自己只提了「一个需求」,后台可能已经走掉好几次 model request 了。

那一次对话到底等于几次请求?官方页面没有给这个换算关系。 这一点必须说清楚:

  • 它取决于你让它干的活有多复杂
  • 取决于中间调了几次工具
  • 取决于有没有触发重试

所以任何「1000 次请求约等于 N 轮对话」的说法都是编的,包括本文也不会给。你要知道自己的真实消耗,只有一条路:实测。干一个你日常规模的典型任务,看额度掉了多少,那个数字才是你自己的换算率。

三、两条上限,哪条先撞取决于你怎么用

每日 1000、每分钟 60,这两条是独立生效的。撞哪条,取决于你的使用节奏。

每分钟 60 次是什么概念?平均一秒一次。听起来很宽裕,但它不是按平均算的——是按那一分钟内的实际次数算的

会撞上分钟限的典型场景:

  • 让 Agent 自主跑一个多步骤任务,它在几十秒里连续调工具、连续请求
  • 同时开着好几个会话干活
  • 脚本里循环调用

会撞上日限的典型场景:

  • 一整天持续在用,节奏不快但没停过

这两种人该关心的完全不是同一个数字。 偶尔重度使用的人(比如集中两小时干一个大项目)先撞的多半是分钟限;细水长流一整天的人先撞的是日限。

搞清楚自己是哪种,才知道升级有没有意义——从个人版升到标准版,每分钟从 60 涨到 120(翻倍),每日从 1000 涨到 1500(只涨 50%)。如果你撞的是分钟限,升级收益明显;如果撞的是日限,收益就小得多。

四、免费的两条路,差了四倍

免费档其实有两条路,很多人是随手选的,但差距不小:

Google 登录免费 API Key
每日1000250
每分钟6010

每分钟 10 次是个相当紧的数字。 一个多步骤的 Agent 任务,六秒钟一次请求就撞线了——实际体验上就是干着干着突然被限流。

所以除非你有特别的理由(比如登录方式在你的环境里过不去),优先用 Google 账号登录这条路

有一种情况会让人被迫退到 API key:登录环节报错。比较常见的两条是「必须是组织订阅的具名用户」(真因通常是环境里有 GOOGLE_CLOUD_PROJECT 变量)和 Request contains an invalid argument(Workspace 账号或关联 Gmail 的 GCP 账号激活不了免费档)。这两条都有官方解法,修好登录比退到 API key 划算得多——退过去等于主动把额度砍到四分之一、频率砍到六分之一。

五、撞线之后会看到什么

额度用完的表现是 429:

API Error: got status: 429 Too Many Requests.

GitHub 上 issue #1502(已关闭,127 条评论)就是这条。看到 429 时,先分清是哪一种:

  • 刚猛干了一阵子突然出现 → 多半是分钟限,等一分钟再试通常就好了
  • 今天一直在用,下午开始持续出现 → 多半是日限,等重置
  • 刚开始用就出现 → 检查是不是落在了 250/天那一档,或者是不是有别的进程在共用同一个账号

还有一种情况值得单独提:如果你通过第三方工具(比如某些编辑器插件)间接调 Gemini,你的 Google AI 付费订阅和 CLI 的免费档可能是两套额度。 Kilo Code 仓库的 issue #4650(已关闭)标题就是 Gemini CLI Provider returns "Free Tier Rate Limit Exceeded" error even with active Google AI Pro——有付费订阅,走 CLI provider 时照样撞免费档的限。遇到这种情况,要查的是那个工具用的是哪条授权路径,而不是怀疑自己的订阅。

六、怎么自测自己的真实消耗

既然官方不给换算,就自己测。方法不复杂:

  1. 挑一个典型任务——你日常最常干的那种规模,不要挑最大的也不要挑最小的
  2. 在干净的会话里跑完,记下花了多久
  3. 看额度掉了多少
  4. 用「一个典型任务 = N 次请求」去乘你一天要干几个,得到日消耗
  5. 再看第 2 步那个耗时里的最密集的一分钟用了几次,判断会不会撞分钟限

测两三次取个大概范围就够了,不用精确——你要的是判断「够不够」,不是记账

七、Vertex AI 那条路,注意那个 90 天

除了上面四档,还有一条路是走 Vertex AI。官方在额度页上给的信息不多,但有一个数字必须记住:Express Mode 是 90 天,之后需要启用付费。

这条对「先免费用着看看」的人是个提醒——它是一段有期限的体验,不是一个长期免费档。 90 天之后不启用付费,这条路就断了。

Vertex AI 和 Gemini API Key 都支持按实际使用的模型和 token 数付费。但要注意,走到这条路上,额度单位就从「请求次数」换成「token」了——跟前面四档不是同一套算法。你在前四档里积累的「一天大概多少次请求」的经验,到这里不能直接用,得重新按 token 估。

具体单价那个页面没给,要去 Vertex AI 和 Gemini API 各自的定价页查。本文不给任何单价数字,因为核对日那天那个页面上确实没有。

八、几句实在话

  • 额度单位是请求次数,不是 token,别用别家的 token 经验来套。
  • 两条上限独立生效,先想清楚自己会撞哪条,再决定要不要升级。
  • 免费档优先走 Google 登录,退到 API key 的代价是四倍日额度、六倍分钟频率。
  • 付费档价格官方那页没给,需要的话去官方定价页确认,别信任何二手数字(包括本文的表——本文只抄了官方给的请求数,没有价格)。
  • 换算关系只能自己测,任何现成的「N 次请求等于 M 轮对话」都是编的。

本文数字来自 Gemini CLI 官方额度与定价页,issue 编号来自 google-gemini/gemini-cli 与 Kilo-Org/kilocode 仓库,核对日 2026-08-08。额度政策会调整,实际以官方页面为准。

相关阅读

想系统学会用 AI?报名体系课或加入会员,照着学、照着用。