// QUÉ SIGNIFICA
Superaste el techo de peticiones por minuto: 60 por minuto en el nivel gratuito. Es un límite de ráfaga, independiente de la ventana de 5 horas y del tope semanal. El modo agente es la causa habitual: un prompt se abre en muchas peticiones al modelo en segundos.
Cuando ves "Switching to fallback model", la CLI ha bajado automáticamente a un modelo más barato para continuar; tus resultados de esos turnos vinieron del modelo de respaldo.
// CUÁNDO SE REINICIA
En menos de un minuto. El techo es una ventana deslizante de un minuto, así que basta con esperar o ralentizar la tarea. No tiene una hora de reinicio en el sentido de la cuota.
Nada que esperar del lado de Google: no es una caída ni una condición general.
// QUÉ HACER AHORA
- 01 Espera 60 segundos y reintenta. Si se repite, divide la tarea para que se disparen menos herramientas por turno.
- 02 Evita ejecutar varias sesiones de Gemini CLI en paralelo con la misma cuenta: comparten el techo por minuto.
- 03 Los niveles de pago Google AI Pro / Ultra tienen techos por minuto más altos; consulta la página Quotas de la consola de Google Cloud para la cifra de tu cuenta.
- 04 Si te cambiaron en silencio a un modelo de respaldo, vuelve a ejecutar los turnos importantes cuando el techo se libere.
// ¿AFECTA A MI CUOTA SEMANAL?
No. Las peticiones rechazadas no se cuentan, así que un límite de ráfaga no te cuesta nada de la ventana de 5 horas ni del tope semanal. Si el mensaje es "Quota exceeded", eso sí es la cuota: mira esa página.
// TAMBIÉN APARECE COMO
- “Rate limiting detected. Switching to fallback model”
- “429 Too Many Requests”
- “Attempt 1 failed with status 429”