● whenaireset

"Rate limiting detected"

Gemini CLI

$ Gemini CLI 打印「Rate limiting detected」或「429 Too Many Requests」?那是每分钟请求上限,不是每日或每周配额。为什么 agent 模式会触发、为什么不耗额度、几秒内怎么解除。

// 这是什么意思

你超过了每分钟请求上限 —— 免费档每分钟 60 次。这是爆发限制,跟 5 小时窗口和周上限无关。agent 模式是常见原因:一个提示几秒内扇出成很多模型请求。

看到「Switching to fallback model」时,CLI 已经自动降到更便宜的模型继续跑;那几轮的结果来自备用模型。

// 什么时候恢复

一分钟内。上限是滑动的一分钟窗口,等一下或把任务放慢就解除了。它没有配额那种意义上的恢复时间。

Google 那边没什么可等的 —— 这不是故障,也不是全员性的状况。

// 现在能做什么

  1. 01 等 60 秒再试。反复出现就把任务拆开,让每轮少触发几个工具。
  2. 02 别在同一个账号上并行跑多个 Gemini CLI session —— 它们共用每分钟上限。
  3. 03 付费的 Google AI Pro / Ultra 每分钟上限更高;Google Cloud 控制台的 Quotas 页有你账号的数字。
  4. 04 如果被悄悄切到了备用模型,上限解除后把重要的几轮重跑一遍。

// 影响周额度吗?

不影响。被拒绝的请求不计数,所以爆发限制不消耗 5 小时窗口或周上限的任何额度。如果提示是「Quota exceeded」,那才是额度 —— 看那一页。

// 其他写法

  • “Rate limiting detected. Switching to fallback model”
  • “429 Too Many Requests”
  • “Attempt 1 failed with status 429”

// 上次全员重置

管理员还没录入这家的重置记录。

// 订阅提醒

Gemini CLI 重置时发邮件给我

每次官方重置一封邮件。没有周报、没有营销,一键退订。 更习惯看 X?重置提醒也会发在 @XIAOMIAO_26 · RSS

// 套餐限额

Free(个人 Google 账号) $0 生效
每分钟 60 次、每天 1,000 次模型请求
Google AI Pro 约 $19.99/月 生效
每人每天 1,500 次模型请求
Google AI Ultra 约 $99.99/月起 生效
每人每天 2,000 次模型请求,另含更多 AI credits
limits →

// 相关报错