// 这是什么意思
你超过了每分钟请求上限 —— 免费档每分钟 60 次。这是爆发限制,跟 5 小时窗口和周上限无关。agent 模式是常见原因:一个提示几秒内扇出成很多模型请求。
看到「Switching to fallback model」时,CLI 已经自动降到更便宜的模型继续跑;那几轮的结果来自备用模型。
// 什么时候恢复
一分钟内。上限是滑动的一分钟窗口,等一下或把任务放慢就解除了。它没有配额那种意义上的恢复时间。
Google 那边没什么可等的 —— 这不是故障,也不是全员性的状况。
// 现在能做什么
- 01 等 60 秒再试。反复出现就把任务拆开,让每轮少触发几个工具。
- 02 别在同一个账号上并行跑多个 Gemini CLI session —— 它们共用每分钟上限。
- 03 付费的 Google AI Pro / Ultra 每分钟上限更高;Google Cloud 控制台的 Quotas 页有你账号的数字。
- 04 如果被悄悄切到了备用模型,上限解除后把重要的几轮重跑一遍。
// 影响周额度吗?
不影响。被拒绝的请求不计数,所以爆发限制不消耗 5 小时窗口或周上限的任何额度。如果提示是「Quota exceeded」,那才是额度 —— 看那一页。
// 其他写法
- “Rate limiting detected. Switching to fallback model”
- “429 Too Many Requests”
- “Attempt 1 failed with status 429”