Glosario de IA
Límite de salida
El número máximo de tokens que un modelo puede generar en una sola respuesta, distinto de cuánto puede leer.
La ventana de contexto es cuánto puede leer el modelo; el límite de salida es cuánto puede escribir de una vez. Suele ser mucho menor: en 2026 son habituales 64.000 o 128.000 tokens, y Gemini 4 Argon lo ha subido a 1 millón.
Importa en documentos largos, cambios grandes de código o traducciones. Si lo alcanzas, la respuesta se corta y tendrás que pedir que continúe o dividir la tarea.
Ejemplo: Pides traducir de una vez un manual de 300 páginas y la respuesta se corta a la mitad. No se ha llenado la ventana de contexto: se ha alcanzado el límite de salida.
En la práctica
- Para textos largos, pide el trabajo por partes, por ejemplo capítulo a capítulo.
- En la API, fija el máximo de tokens de salida con margen para que la respuesta no se corte.
- Límites actuales: 128.000 tokens en Claude Opus 5.5 y GPT-6 Astra, y 64.000 en Claude Haiku 4.5.
El salto a un millón de tokens de salida, en la noticia de Gemini 4 Argon.