← Últimos artigos
🤖 machine learning

Why Does CLAUDE.md Keep Growing? Catastrophic Remembering in Agentic Coding

Este artigo identifica o "esquecimento catastrófico" como a causa do crescimento ilimitado em prompts de codificação agentes como o CLAUDE.md, demonstrando que anexar instruções é barato enquanto deletá-las é computacionalmente proibitivo, e propõe que incorporar o raciocínio latente em comentários de prompt pode efetivamente interromper essa divergência e melhorar significativamente o desempenho no seguimento de instruções.

Autores originais: Kushal Chakrabarti

Publicado 2026-08-12
📖 7 min de leitura🧠 Leitura aprofundada

Autores originais: Kushal Chakrabarti

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você está ensinando um robô assistente muito inteligente, mas um pouco esquecido, a fazer um trabalho específico, como escrever posts de blog ou consertar código. Você começa dando a ele uma lista simples de regras: "Use três parágrafos", "Não use a palavra 'muito'", e "Sempre termine com um sorriso". Isso é chamado de prompt. No mundo da inteligência artificial, esses prompts são como os manuais de instrução para robôs.

Agora, imagine que o robô comete um erro. Você o corrige adicionando uma nova regra: "Ok, e certifique-se de usar exatamente cinco tópicos". O robô tenta novamente, falha, e você adiciona outra regra: "E lembre-se de capitalizar a primeira letra de cada frase". Com o tempo, essa lista de regras fica cada vez mais longa. Na ciência da computação, existe um problema famoso chamado esquecimento catastrófico (catastrophic forgetting), onde um robô aprende algo novo e acidentalmente apaga sua memória das coisas antigas. Mas este artigo fala sobre o problema oposto: lembrança catastrófica (catastrophic remembering). Isso é quando um robô (ou o humano que o gerencia) continua adicionando regras, mas nunca deleta as antigas, mesmo quando elas não são mais necessárias. A lista torna-se tão enorme e bagunçada que o robô fica confuso, fica lento e começa a cometer erros novamente. A grande questão é: Por que essa lista continua crescendo para sempre, e como paramos isso?

O Mistério da Lista Sem Fim

O autor deste artigo, Kushal Chakrabarti, da South Park Commons, decidiu investigar por que essas listas de instruções "agênticas" (arquivos frequentemente nomeados como CLAUDE.md ou AGENTS.md em projetos de software) parecem crescer sem limites. Eles analisaram quase 1.870 projetos de software reais no GitHub e rastrearam a vida de mais de 247.000 instruções individuais.

Eles encontraram um padrão estranho: essas listas quase nunca diminuem. Em vez disso, elas crescem em uma média de 4,9 novas instruções para cada atualização feita no arquivo. Ao longo da vida de um arquivo, o número de instruções mais do que triplica, crescendo 226%. O arquivo médio termina com 39 instruções, mas alguns têm mais de 100.

Os pesquisadores perguntaram: Por que as pessoas não deletam apenas as regras velhas e inúteis?

Eles descobriram que o culpado não é que as regras sejam "obsoletas" (desatualizadas) ou que as regras ruins morram cedo. Em vez disso, o problema é a memória imperfeita (imperfect recall). Pense nisso desta forma: Quando você adiciona uma nova regra à lista, você sabe por que a adicionou. Talvez você tenha adicionado "Use três parágrafos" porque o robô continuava escrevendo quatro. Mas esse "porquê" é apenas um pensamento na sua cabeça. Ele não está escrito.

Com o passar do tempo e conforme outras pessoas editam o arquivo, ou conforme o projeto muda, aquele motivo original desaparece. Se você olhar para a lista seis meses depois, verá a regra "Use três parágrafos", mas não terá ideia de por que ela está lá. Foi porque o robô estava muito tagarela? Foi porque o chefe pediu? Sem esse motivo, deletar a regra parece arriscado. Você tem medo de que, se deletar a regra, o robô quebrará novamente. Então, você a deixa lá. Enquanto isso, você continua adicionando novas regras para novos problemas. O resultado é uma lista de regras inchada e confusa que ninguém entende mais. O autor chama isso de lembrança catastrófica: manter tudo o que você deveria ter esquecido.

O Efeito "Bulldozer"

O estudo também descobriu algo engraçado sobre como as pessoas tentam consertar essas listas bagunçadas. Elas raramente deletam apenas uma ou duas regras ruins. Em vez disso, elas tendem a apertar o botão "deletar tudo". Os dados mostraram que 76,8% de todas as deleções de instruções acontecem em uma grande "reescrita" onde alguém deleta metade ou mais do arquivo de uma só vez. É como um jardineiro que não consegue decidir quais ervas daninhas arrancar, então ele simplesmente queima todo o jardim e começa do zero.

Mas aqui está o detalhe: mesmo após essa "queima", o jardim cresce novamente. A lista começa a crescer novamente, no mesmo ritmo acelerado de antes. Isso é chamado de efeito catraca (ratchet effect). O tamanho cai, mas a taxa de crescimento não muda. A causa raiz — o fato de que as pessoas não conseguem lembrar por que as regras foram adicionadas em primeiro lugar — nunca foi corrigida, então a lista simplesmente começa a encher de novo.

A Magia dos "Comentários"

Então, como impedimos que a lista cresça para sempre? O artigo sugere uma solução que engenheiros de software usam há décadas: comentários.

No código de computador comum, programadores escrevem pequenas notas ao lado de seu código para explicar por que escreveram daquela forma. Essas notas são invisíveis para o computador, mas úteis para o próximo humano que ler o código. Os pesquisadores testaram se esse mesmo truque funciona para prompts de IA.

Eles configuraram uma simulação onde "mantenedores" (agentes de IA) tinham que construir e consertar um prompt. Em um grupo, eles tinham que escrever instruções sem nenhuma nota. No outro grupo, eles podiam adicionar um comentário ao lado de cada instrução explicando o motivo. Por exemplo, ao lado de "Use três parágrafos", o comentário poderia dizer: "Adicionado porque o robô continuava escrevendo quatro parágrafos na rodada 3".

Os resultados foram dramáticos.

  • Sem comentários: O prompt cresceu para ser 211,3% maior do que o tamanho mínimo ideal necessário para realizar o trabalho.
  • Com comentários: O prompt manteve um tamanho quase perfeito, crescendo apenas 1,4% acima do mínimo.

Os comentários agiram como uma máquina do tempo. Eles preservaram o "raciocínio latente" (o motivo oculto) para cada regra. Quando um mantenedor olhava para a lista mais tarde, ele podia ver o comentário, entender que aquela regra ainda era necessária, ou perceber que não era mais necessária, e deletá-la com segurança. Os comentários removeram 99,3% das instruções excessivas e desnecessárias.

Isso Realmente Funciona Melhor?

Os pesquisadores não pararam apenas em tornar as listas mais curtas; eles verificaram se os robôs realmente faziam um trabalho melhor. Eles descobriram que, quando os prompts estavam inchados com instruções inúteis e ruidosas, os robôs ficavam confusos e cometiam mais erros. Ao usar comentários para manter a lista limpa e focada, a capacidade dos robôs de seguir instruções melhorou em até 23,1%.

O estudo também mostrou que isso funciona mesmo quando as instruções são complexas e os "mantenedores" são agentes de IA muito inteligentes. Quanto mais capaz é a IA, mais ela tende a adicionar regras em excesso, mas mais ela se beneficia de ter esses comentários úteis para manter o controle.

A Grande Lição

O artigo conclui com uma pergunta lúdica, mas séria: "Se o inglês é o novo código, por que ainda não temos comentários?"

Assim como os programadores humanos aprenderam há muito tempo que você precisa explicar por que escreveu uma linha de código, as pessoas (e os agentes de IA) que gerenciam esses prompts de IA precisam começar a escrever o porquê de terem adicionado uma regra. Sem essa explicação, as regras se acumulam, o sistema fica confuso e o desempenho cai. A solução não é parar de adicionar regras; é escrever uma pequena nota ao lado de cada uma para que a próxima pessoa (ou robô) saiba exatamente o que manter e o que descartar. Isso transforma um monstro caótico e crescente em uma ferramenta limpa e eficiente.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →