Una ventana de contexto de 2 millones de tokens —suficientemente amplia para ingerir ocho novelas completas de forma simultánea— se incluyó como característica estándar del Gemini 3.1 Ultra de Google cuando el modelo se lanzó en abril de 2026, duplicando el punto de referencia de producción anterior y estableciendo un nuevo estándar operativo para los despliegues de IA empresarial. Ningún modelo competidor en disponibilidad general lo iguala.
Las ventanas de contexto son la memoria de trabajo de un modelo de lenguaje durante una sesión: cada token adicional permite al sistema mantener más información activa al mismo tiempo. Gemini 2.0 Ultra, lanzado a finales de 2025, contaba con una ventana de contexto de 1 millón de tokens. El GPT-5 de OpenAI, que se lanzó en marzo de 2026, ofrece 256.000 tokens como nivel estándar de consumidor. La duplicación hasta 2 millones no es principalmente una característica para el consumidor —la mayoría de las personas nunca escribirá un prompt de 2 millones de tokens—, pero para casos de uso empresarial como el descubrimiento legal, la síntesis de historiales médicos, las auditorías de código de software y el análisis financiero de largo aliento, la mayor capacidad es prácticamente significativa y cambia qué tareas pueden completarse en una sola sesión sin truncamiento.
Continue reading to see the full article