Uma janela de contexto de 2 milhões de tokens — grande o suficiente para absorver oito romances completos simultaneamente — foi incluída como recurso padrão no Gemini 3.1 Ultra do Google quando o modelo foi lançado em abril de 2026, dobrando o benchmark de produção anterior e estabelecendo um novo padrão operacional para implantações de IA empresarial. Nenhum modelo concorrente em disponibilidade geral o iguala.
As janelas de contexto são a memória de trabalho de um modelo de linguagem durante uma sessão: cada token adicional permite que o sistema mantenha mais informações ativas ao mesmo tempo. O Gemini 2.0 Ultra, lançado no final de 2025, tinha uma janela de contexto de 1 milhão de tokens. O GPT-5 da OpenAI, lançado em março de 2026, oferece 256.000 tokens como nível padrão para consumidores. O salto para 2 milhões não é primariamente um recurso para o consumidor comum — a maioria das pessoas jamais escreverá um prompt de 2 milhões de tokens — mas para casos de uso empresarial como descoberta jurídica, síntese de prontuários médicos, auditorias de código de software e análises financeiras de longa duração, a capacidade ampliada é praticamente significativa e muda quais tarefas podem ser concluídas em uma única sessão sem truncamento.
Continue reading to see the full article