Glosario de IA
Límite de uso (rate limit)
El número máximo de peticiones o de tokens que puedes enviar a una API en un periodo, por ejemplo por minuto.
Los proveedores limitan el uso para repartir capacidad y evitar abusos. Si te pasas, la API devuelve un error (a menudo HTTP 429) y hay que esperar y reintentar. Los límites suelen crecer a medida que gastas más o subes de nivel de uso.
En la práctica: reintenta con esperas crecientes, reparte el trabajo en el tiempo y usa el procesamiento por lotes para trabajos grandes que no corran prisa. Las suscripciones de chat tienen sus propios límites, que a menudo se renuevan cada pocas horas.
Ejemplo: Lanzas 500 peticiones a la vez para traducir una web. A partir de cierto número, la API responde con un error 429 («demasiadas peticiones»); tu programa espera unos segundos y reintenta las que fallaron.