- Olympus News
- Posts
- Context Degradation — por que seu agente piora com o tempo
Context Degradation — por que seu agente piora com o tempo
Memória enche, skills enferrujam, contexto apodrece. O problema nunca foi o prompt.
Imagine um assistente preparado para responder dúvidas de clientes. Ele conhece os planos, sabe explicar o produto e escreve bem. Meses depois, a empresa muda as condições de cancelamento. A página oficial recebe a atualização. O documento usado para orientar o assistente, não.
Um cliente pergunta como cancelar. A resposta chega rápida, educada e errada.
Esse exemplo hipotético mostra um problema fácil de confundir com uma limitação do modelo. Talvez ele consiga interpretar perfeitamente a política nova. Mas recebeu a antiga, sem nenhuma indicação de que ela perdeu a validade.
Antes de trocar de modelo ou reescrever o prompt, vale perguntar: o agente está trabalhando com a versão atual da realidade?
Quando informação antiga vira instrução atual
Neste texto, context degradation significa a perda de utilidade do contexto que um agente recebe ao longo do tempo. Referências envelhecem, exceções viram regras e orientações incompatíveis passam a disputar a mesma decisão.
Não é um diagnóstico para qualquer resposta ruim. O modelo pode ter mudado, uma ferramenta pode estar indisponível ou o pedido pode estar ambíguo. Também é diferente de perder detalhes numa conversa longa. Aqui, o problema pode sobreviver a um chat novo: o sistema volta a carregar a mesma informação vencida.
A dificuldade é que um documento desatualizado costuma continuar parecendo confiável. Tem título, organização e instruções claras. Às vezes, justamente por ser mais detalhado que a fonte atual, oferece ao agente um caminho muito conveniente para responder.
Uma instrução pode estar bem escrita e continuar sendo a instrução errada para hoje.
Três lugares onde o contexto envelhece
Na memória. Pense numa preferência temporária: "durante esta campanha, priorize o produto de entrada". Se ela for guardada como orientação permanente, o assistente poderá continuar recomendando a mesma estratégia depois que a campanha terminar. O erro começa quando uma decisão com prazo perde o prazo ao ser salva.
Isso não significa que memória cheia seja necessariamente memória ruim. Um registro curto e incorreto pode atrapalhar mais que uma referência longa e pertinente. O que importa é saber a quais situações aquela informação se aplica e quando precisa ser conferida novamente.
Nos procedimentos. Considere um agente que prepara relatórios seguindo um roteiro salvo. A fonte de dados muda, uma coluna ganha outro significado e o roteiro continua igual. O arquivo final pode sair bem formatado, com todos os campos preenchidos, mas comparar coisas diferentes.
Skills e checklists são úteis porque evitam redescobrir o caminho a cada tarefa. Essa vantagem cobra manutenção: quando uma dependência muda, o procedimento precisa ser testado de novo. Ter funcionado antes explica por que ele foi salvo; não garante que ainda funcione.
Nas referências. Agora imagine uma equipe que substituiu sua planilha de preços por um catálogo central. A planilha continua acessível, e o agente ainda recebe a instrução de consultá-la. Não falta informação atualizada. Falta um caminho que leve até ela e deixe claro qual fonte prevalece.
Os exemplos são hipotéticos, mas a distinção ajuda na investigação. Uma memória fora de lugar, um procedimento vencido e uma referência errada pedem correções diferentes. Adicionar "confira tudo antes de responder" não resolve nenhuma delas por si só.
Quatro perguntas para investigar
Estas perguntas organizam uma revisão. Não são um teste com pontuação nem uma forma de provar, sozinhas, por que o desempenho caiu.
1. O que está sendo carregado sem precisar?
Olhe para o material que acompanha toda tarefa. Há histórico de projetos encerrados? Exceções que só valiam para uma entrega? Detalhes que deveriam aparecer apenas quando aquele assunto fosse consultado?
A saída não é apagar tudo que ficou algum tempo sem uso. Uma regra de segurança pode ser raramente acionada e continuar essencial. Separe o que precisa estar sempre presente do que pode ser recuperado sob demanda. Preserve o histórico fora das instruções ativas.
2. Que informação pode ter perdido a validade?
Preços, responsáveis, prazos e estados de projeto mudam. Preferências de escrita tendem a mudar menos. Tratar tudo como memória permanente coloca informações com ritmos diferentes na mesma gaveta.
Para cada afirmação que muda uma decisão, procure sua origem. Ela descreve um fato atual, uma preferência estável ou um registro histórico? Se ninguém consegue responder, o agente deveria conferir a fonte antes de usá-la como verdade.
3. Duas fontes estão mandando fazer coisas diferentes?
Uma política diz que todo reembolso precisa de aprovação. Um roteiro antigo permite resolver diretamente. Os dois documentos continuam disponíveis. Qual vale?
Escrever mais uma regra por cima pode aumentar a confusão. Identifique a orientação vigente, marque a anterior como substituída e faça essa distinção chegar ao agente. Guarde versões antigas para consulta, sem apresentá-las como instruções concorrentes.
4. Como saber se a correção ajudou?
Escolha uma tarefa com critérios verificáveis. No exemplo do cancelamento, conferir a política vigente importa mais que julgar se a resposta "soou melhor". Inclua também situações em que o comportamento anterior já estava correto.
Compare o contexto antigo com o revisado, mantendo modelo, ferramentas e entradas iguais quando possível. Repita o teste: uma única resposta melhor pode ser variação. Se outras condições mudaram junto, registre a limitação em vez de atribuir todo o resultado à limpeza.
O que eu realmente penso
Personalizar um agente dá uma sensação boa de progresso. Cada nova memória ou procedimento parece uma capacidade a mais. A pergunta menos agradável é o que passou a ser responsabilidade de alguém manter.
Eu prefiro um conjunto menor de instruções que consigo explicar a uma biblioteca enorme cuja validade ninguém verifica. Isso não exige minimalismo a qualquer custo. Um agente especializado pode precisar de referências extensas. Ele precisa, sobretudo, saber quais consultar e por que confiar nelas.
Trocar de modelo pode ajudar. Só não deveria ser a primeira resposta para um assistente que continua recebendo a tabela de preços errada.
Sua missão para os próximos 7 dias
Escolha uma tarefa recorrente e revise o contexto que a sustenta. Não comece uma faxina em todos os agentes.
Separe as instruções e referências usadas nessa tarefa. Identifique uma inconsistência concreta: algo vencido, contraditório ou carregado no lugar errado. Guarde uma cópia da versão anterior e faça uma correção pequena, reversível.
Depois, compare as duas versões nos mesmos casos, sem executar ações reais de risco. Registre o que melhorou, o que piorou e o que ainda não dá para concluir. Se não houver diferença, investigue outra causa.
Por fim, defina quem revisa aquele material e em qual situação: mudança de política, atualização da ferramenta ou revisão periódica. Coloque o lembrete na agenda ou no gerenciador de tarefas. Uma frase perdida nas instruções do agente não garante que a manutenção aconteça.
O objetivo da semana é conseguir explicar por que aquele contexto ainda merece confiança.
Como você avalia a newsletter de hoje?Sua resposta será utilizada para guiar os próximos conteúdos. |
Faça Login ou Inscrever-se para participar de pesquisas. |
Conteúdos recomendados
Thariq — context engineering: discussão sobre instruções enxutas e referências carregadas conforme a necessidade.
Garry Tan — Agent Complexity Ratchet: uma perspectiva complementar sobre testes e documentação para preservar qualidade.
Forte abraço.