Janela de Contexto
A mesa de trabalho do modelo: a janela de contexto é o volume máximo de texto, medido em tokens, que o modelo consegue considerar de uma vez numa conversa ou tarefa. Tudo que está na janela pode ser usado na resposta; o que não coube, ou já saiu, simplesmente não existe para o modelo naquele momento, por mais que tenha sido dito antes.
Exemplo Prático
Analisar um prospecto de trezentas páginas exige que ele caiba na janela, ou que o sistema o fatie com inteligência; numa conversa longa, o assistente que "esqueceu" a instrução do início não teve má vontade: a instrução saiu da mesa. Janelas maiores ampliaram o possível, sem revogar o limite.
PlatomAI Explica
A janela de contexto é a memória de trabalho da IA, e confundi-la com memória permanente é a fonte de metade das frustrações de uso: o modelo não guarda a conversa de ontem, e dentro da própria sessão só enxerga o que está sobre a mesa. A régua prática desta casa: documentos críticos entram na janela na hora da pergunta, instruções importantes se repetem, e sistemas profissionais gerenciam esse limite por arquitetura, o RAG, de novo, trazendo à mesa só o trecho que importa.

