Quando uma conversa ou documento ultrapassa a janela de contexto de um modelo, informações mais antigas precisam ser resumidas ou descartadas pra caber o que ainda falta processar.
Modelos diferentes têm janelas de tamanhos bem diferentes — de alguns milhares a mais de um milhão de tokens — e isso afeta diretamente quanto texto ou código um assistente de IA consegue considerar de uma vez.