Model fundamentals

Janela de contexto

A janela de contexto é a quantidade máxima de texto — medida em tokens — que um modelo consegue considerar de uma só vez, abrangendo o system prompt, a conversa até então, os resultados de ferramentas e a resposta que ele está gerando.

Tudo o que o modelo "vê" em um dado turno precisa caber na janela de contexto. Para um agente, isso enche rápido: o system prompt, cada mensagem do usuário e cada resultado de ferramenta se acumulam turno após turno. Quando a janela se esgota, o conteúdo mais antigo ou menos relevante precisa ser descartado ou resumido, ou o modelo simplesmente não consegue assimilá-lo. Gerenciar a janela — o que manter, compactar ou buscar sob demanda — é um dos problemas centrais de engenharia na construção de agentes.

Pontos-chave

  • Medida em tokens (aproximadamente ¾ de uma palavra em inglês); limita a entrada + a saída combinadas.
  • Em um agente, é consumida pelo system prompt, pela conversa em andamento e pelos resultados de ferramentas.
  • Quando enche, o contexto precisa ser compactado, resumido ou buscado sob demanda — veja retrieval-augmented generation.
  • Uma janela maior ajuda, mas não é de graça: mais tokens significam maior custo, latência e o risco de o modelo perder o foco.

Aprenda construindo

O Way of the Agent ensina engenharia de agentes de IA nível a nível — conceitos como este e depois prática, XP e as AI Chronicles.

Começar grátis →