← Ultimi articoli
🤖 machine learning

Why Does CLAUDE.md Keep Growing? Catastrophic Remembering in Agentic Coding

Questo articolo identifica il "ricordo catastrofico" come la causa della crescita illimitata nei prompt di codifica agentica come CLAUDE.md, dimostrando che l'aggiunta di istruzioni è economica mentre la loro cancellazione è computazionalmente proibitiva, e propone che l'incorporamento del ragionamento latente nei commenti dei prompt possa arrestare efficacemente questa divergenza e migliorare significativamente le prestazioni nel seguire le istruzioni.

Autori originali: Kushal Chakrabarti

Pubblicato 2026-08-12
📖 6 min di lettura🧠 Approfondimento

Autori originali: Kushal Chakrabarti

Articolo originale sotto licenza CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Questa è una spiegazione generata dall'IA dell'articolo qui sotto. Non è stata scritta né approvata dagli autori. Per precisione tecnica, consulta l'articolo originale. Leggi il disclaimer completo

Immagina di dover insegnare a un robot assistente, molto intelligente ma un po' smemorato, come svolgere un lavoro specifico, come scrivere post per un blog o correggere del codice. Inizi fornendogli un semplice elenco di regole: "Usa tre paragrafi", "Non usare la parola 'molto'", "Finisci sempre con un sorriso". Questo è un prompt. Nel mondo dell'intelligenza artificiale, questi prompt sono come i manuali di istruzioni per i robot.

Ora, immagina che il robot commetta un errore. Lo correggi aggiungendo una nuova regola: "Ok, e assicurati di usare esattamente cinque punti elenco". Il robot riprova, fallisce, e tu aggiungi un'altra regola: "E ricorda di scrivere la prima lettera di ogni frase con la maiuscola". Con il tempo, questo elenco di regole diventa sempre più lungo e lungo. In informatica, esiste un problema famoso chiamato oblio catastrofico (catastrophic forgetting), dove un robot impara qualcosa di nuovo e accidentalmente cancella dalla memoria le cose vecchie. Ma questo articolo parla del problema opposto: la memoria catastrofica (catastrophic remembering). È quando un robot (o l'umano che lo gestisce) continua ad aggiungere regole ma non elimina mai quelle vecchie, anche quando non sono più necessarie. L'elenco diventa così enorme e disordinato che il robot si confonde, rallenta e ricomincia a commettere errori. La grande domanda è: perché questo elenco continua a crescere all'infinito e come possiamo fermarlo?

Il mistero dell'elenco infinito

L'autore di questo articolo, Kushal Chakrabarti di South Park Commons, ha deciso di indagare perché questi elenchi di istruzioni "agentiche" (file spesso chiamati CLAUDE.md o AGENTS.md nei progetti software) sembrano crescere senza limiti. Hanno esaminato quasi 1.870 progetti software reali su GitHub e hanno monitorato la vita di oltre 247.000 singole istruzioni.

Hanno scoperto un modello strano: questi elenchi quasi mai si rimpiccioliscono. Invece, crescono in media di 4,9 nuove istruzioni per ogni singolo aggiornamento del file. Durante la vita di un file, il numero di istruzioni più che triplica, crescendo del 226%. Il file medio finisce con 39 istruzioni, ma alcuni ne hanno più di 100.

I ricercatori si sono chiesti: perché le persone non cancellano semplicemente le vecchie regole inutili?

Hanno scoperto che il colpevole non è che le regole siano "obsolete" (stale) o che le regole cattive muoiano giovani. Invece, il problema è l'imperfetta memoria (imperfect recall). Pensatelo in questo modo: quando aggiungete una nuova regola all'elenco, sapete perché l'avete aggiunta. Magari avete aggiunto "Usa tre paragrafi" perché il robot continuava a scriverne quattro. Ma quel "perché" è solo un pensiero nella vostra testa. Non è scritto.

Con il passare del tempo e con l'intervento di altre persone che modificano il file, o man mano che il progetto cambia, quella ragione originale svanisce. Se guardate l'elenco sei mesi dopo, vedete la regola "Usa tre paragrafi", ma non avete idea del perché sia lì. Era perché il robot era troppo prolisso? Era perché il capo lo aveva chiesto? Senza quella ragione, eliminare la regola sembra rischioso. Avete paura che, se la eliminate, il robot si romperà di nuovo. Quindi, la lasciate lì. Nel frattempo, continuate ad aggiungere nuove regole per nuovi problemi. Il risultato è un elenco di regole gonfio e confuso che nessuno capisce più. L'autore lo chiama memoria catastrofica: tenere tutto ciò che si sarebbe dovuto dimenticare.

L'effetto "Bulldozer"

Lo studio ha scoperto anche qualcosa di buffo su come le persone cercano di sistemare questi elenchi disordinati. Raramente cancellano solo una o due regole cattive. Invece, tendono a premere il tasto "elimina tutto". I dati hanno mostato che il 76,8% di tutte le eliminazioni di istruzioni avviene in un unico "riscrittura" gigante in cui qualcuno cancella metà o più del file in una volta sola. È come un giardiniere che non riesce a decidere quali erbacce estirpare, quindi brucia l'intero giardino e ricomincia da capo.

Ma ecco il colpo di scena: anche dopo questo "incendio", il giardino ricresce. L'elenco ricomincia a crescere immediatamente, con lo stesso ritmo veloce di prima. Questo è chiamato l'effetto a cricchetto (ratchet effect). La dimensione diminuisce, ma il ritmo di crescita non cambia. La causa principale — il fatto che le persone non ricordano perché le regole sono state aggiunte in primo luogo — non è mai stata risolta, quindi l'elenco ricomincia semplicemente a riempirsi di nuovo.

La magia dei "Commenti"

Quindi, come fermiamo l'elenco che cresce all'infinito? L'articolo suggerisce una soluzione che gli ingegneri del software usano da decenni: i commenti.

Nel codice informatico regolare, i programmatori scrivono piccole note accanto al loro codice per spiegare perché l'hanno scritto in quel modo. Queste note sono invisibili al computer ma utili per il prossimo essere umano che leggerà il codice. I ricercatori hanno testato se questo stesso trucco funziona per i prompt dell'IA.

Hanno allestito una simulazione in cui i "maintainer" (agenti IA) dovevano costruire e correggere un prompt. In un gruppo, dovevano scrivere istruzioni senza alcuna nota. Nell'altro gruppo, potevano aggiungere un commento accanto a ogni istruzione spiegando la ragione. Per esempio, accanto a "Usa tre paragrafi", il commento potrebbe dire: "Aggiunto perché il robot continuava a scrivere quattro paragrafi nel round 3".

I risultati sono stati drammatici.

  • Senza commenti: il prompt è diventato il 211,3% più grande della dimensione minima perfetta necessaria per svolgere il lavoro.
  • Con i commenti: il prompt è rimasto quasi perfettamente dimensionato, crescendo solo dell'1,4% rispetto al minimo.

I commenti hanno agito come una macchina del tempo. Hanno preservato il "ragionamento latente" (la ragione nascosta) per ogni regola. Quando un manutentore guardava l'elenco più tardi, poteva vedere il commento, capire se la regola era ancora necessaria, o rendersi conto che non era più necessaria, e cancellarla in sicurezza. I commenti hanno eliminato il 99,3% delle istruzioni superflue e non necessarie.

Funziona davvero meglio?

I ricercatori non si sono fermati al rendere gli elenchi più brevi; hanno controllato se i robot facessero effettivamente un lavoro migliore. Hanno scoperto che quando i prompt erano gonfi di istruzioni inutili e rumorose, i robot si confondevano e commettevano più errori. Usando i commenti per mantenere l'elenco pulito e focalizzato, la capacità dei robot di seguire le istruzioni è migliorata fino al 23,1%.

Lo studio ha anche dimostrato che questo funziona anche quando le istruzioni sono complesse e i "manutentori" sono agenti IA molto intelligenti. Più l'IA è capace, più tende ad aggiungere troppe regole, ma più beneficia di avere quei commenti utili per tenerle sotto controllo.

La grande lezione

L'articolo si conclude con una domanda giocosa ma seria: "Se l'inglese è il nuovo codice, perché non abbiamo ancora i commenti?"

Proprio come i programmatori umani hanno imparato tempo fa che è necessario spiegare perché si è scritta una riga di codice, le persone (e gli agenti IA) che gestiscono questi prompt dell'IA devono iniziare a scrivere perché hanno aggiunto una regola. Senza questa spiegazione, le regole si accumulano, il sistema si confonde e le prestazioni calano. La soluzione non è smettere di aggiungere regole; è scrivere una piccola nota accanto a ciascuna in modo che la persona successiva (o il robot) sappia esattamente cosa tenere e cosa scartare. Trasforma un mostro caotico e in crescita in uno strumento pulito ed efficiente.

Sommerso dagli articoli nel tuo campo?

Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.

Prova Digest →