// CE QUE ÇA VEUT DIRE
Vous avez dépassé le plafond de requêtes par minute — 60 par minute sur le palier gratuit. C'est une limite de rafale, distincte de la fenêtre de 5 heures et du plafond hebdo. Le mode agent en est la cause habituelle : un prompt se démultiplie en de nombreuses requêtes modèle en quelques secondes.
Quand vous voyez « Switching to fallback model », la CLI est automatiquement passée à un modèle moins cher pour continuer ; vos résultats pour ces tours viennent du modèle de repli.
// QUAND ÇA SE RÉINITIALISE
En moins d'une minute. Le plafond est une fenêtre glissante d'une minute, il suffit d'attendre ou de ralentir la tâche pour le lever. Il n'a pas d'heure de reset au sens du quota.
Rien à attendre côté Google — ce n'est ni une panne ni une condition globale.
// QUOI FAIRE MAINTENANT
- 01 Attendez 60 secondes et réessayez. Si ça revient, découpez la tâche pour que moins d'outils se déclenchent par tour.
- 02 Évitez de faire tourner plusieurs sessions Gemini CLI en parallèle sur le même compte — elles partagent le plafond par minute.
- 03 Les paliers payants Google AI Pro / Ultra ont des plafonds par minute plus élevés ; consultez la page Quotas de la console Google Cloud pour le chiffre de votre compte.
- 04 Si vous avez été basculé en silence sur un modèle de repli, relancez les tours importants une fois le plafond levé.
// ÇA TOUCHE MON QUOTA HEBDO ?
Non. Les requêtes rejetées ne sont pas comptées, une limite de rafale ne vous coûte donc rien sur la fenêtre de 5 heures ni sur le plafond hebdo. Si le message est plutôt « Quota exceeded », c'est le quota — voyez cette page-là.
// APPARAÎT AUSSI SOUS LA FORME
- “Rate limiting detected. Switching to fallback model”
- “429 Too Many Requests”
- “Attempt 1 failed with status 429”