Tecnologia & IA
O que é Context Window (Janela de Contexto)?
Context window é o limite máximo de tokens (input + output) que um LLM consegue processar em uma chamada — varia de 4k a 2M+ entre modelos.
GPT-3.5 = 16k, GPT-4o = 128k, Claude 4 = 200k, Gemini 1.5 = 2M. Janela maior abre cenários (analisar documentos inteiros, código de um repo todo), mas custa mais e processa mais devagar.
Truque: "lost in the middle" — modelos prestam mais atenção no início e fim do contexto. Coloque instruções críticas no topo OU no rodapé, não escondidas no meio.
Perguntas frequentes
Contexto maior é sempre melhor?
Não. Custa mais e tem "lost in the middle". Pra muito contexto, RAG (buscar trechos relevantes) costuma vencer.
Se passar o limite, o que acontece?
API retorna erro. Solução: truncar input, sumarizar ou usar RAG pra pegar só o relevante.