← Derniers articles
🤖 machine learning

Why Does CLAUDE.md Keep Growing? Catastrophic Remembering in Agentic Coding

Cet article identifie le « souvenir catastrophique » comme la cause de la croissance non bornée des invites de codage agentiques telles que CLAUDE.md, démontrant que l'ajout d'instructions est peu coûteux tandis que leur suppression est informatiquement prohibitive, et propose que l'intégration du raisonnement latent dans les commentaires de l'invite peut efficacement stopper cette divergence et améliorer significativement la performance de suivi des instructions.

Auteurs originaux : Kushal Chakrabarti

Publié 2026-08-12
📖 7 min de lecture🧠 Analyse approfondie

Auteurs originaux : Kushal Chakrabarti

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Imaginez que vous enseignez à un robot assistant très intelligent, mais légèrement distrait, comment effectuer un travail spécifique, comme écrire des articles de blog ou corriger du code. Vous commencez par lui donner une liste de règles simples : « Utilise trois paragraphes », « N'utilise pas le mot "très" » et « Termine toujours par un sourire ». Cela s'appelle un prompt. Dans le monde de l'intelligence artificielle, ces prompts sont comme les manuels d'instruction pour les robots.

Maintenant, imaginez que le robot commette une erreur. Vous la corrigez en ajoutant une nouvelle règle : « D'accord, et assure-toi d'utiliser exactement cinq points de liste. » Le robot essaie à nouveau, échoue, et vous ajoutez une autre règle : « Et n'oublie pas de mettre une majuscule au premier mot de chaque phrase. » Avec le temps, cette liste de règles devient de plus en plus longue. En informatique, il existe un problème célèbre appelé oubli catastrophique, où un robot apprend quelque chose de nouveau et efface accidentellement sa mémoire de ce qu'il savait déjà. Mais ce document parle du problème opposé : le souvenir catastrophique. C'est lorsqu'un robot (ou l'humain qui le gère) continue d'ajouter des règles mais ne supprime jamais les anciennes, même lorsqu'elles ne sont plus nécessaires. La liste devient si énorme et désordonnée que le robot s'embrouille, ralentit et recommence à faire des erreurs. La grande question est : pourquoi cette liste continue-t-elle de croître indéfiniment, et comment l'arrêter ?

Le mystère de la liste sans fin

L'auteur de ce document, Kushal Chakrabarti de South Park Commons, a décidé d'enquêter sur la raison pour laquelle ces listes d'instructions « agentiques » (des fichiers souvent nommés CLAUDE.md ou AGENTS.md dans les projets logiciels) semblent croître sans limite. Ils ont examiné près de 1 870 projets logiciels réels sur GitHub et ont suivi la vie de plus de 247 000 instructions individuelles.

Ils ont découvert un étrange schéma : ces listes ne diminuent presque jamais. Au lieu de cela, elles croissent en moyenne de 4,9 nouvelles instructions pour chaque mise à jour du fichier. Au cours de la vie d'un fichier, le nombre d'instructions fait plus que tripler, augmentant de 226 %. Le fichier moyen finit avec 39 instructions, mais certains en comptent plus de 100.

Les chercheurs se sont demandé : pourquoi les gens ne suppriment-ils pas simplement les anciennes règles inutiles ?

Ils ont découvert que le coupable n'est pas que les règles soient « obsolètes » (dépassées) ou que les mauvaises règles meurent jeunes. Au contraire, le problème est le rappel imparfait. Pensez-y de cette façon : quand vous ajoutez une nouvelle règle à la liste, vous savez pourquoi vous l'avez ajoutée. Peut-être avez-vous ajouté « Utilise trois paragraphes » parce que le robot en écrivait quatre. Mais ce « pourquoi » n'est qu'une pensée dans votre tête. Ce n'est pas écrit.

Avec le temps, d'autres personnes modifient le fichier, ou le projet change, et la raison d'origine s'efface. Si vous regardez la liste six mois plus tard, vous voyez la règle « Utilise trois paragraphes », mais vous n'avez aucune idée de la raison de sa présence. Était-ce parce que le robot était trop bavard ? Était-ce parce que le patron l'avait demandé ? Sans cette raison, supprimer la règle semble risqué. Vous avez peur que si vous la supprimez, le robot se mette de nouveau à faire des erreurs. Alors, vous la laissez là. Pendant ce temps, vous continuez à ajouter de nouvelles règles pour de nouveaux problèmes. Le résultat est une liste de règles gonflée et confuse que plus personne ne comprend. L'auteur appelle cela le souvenir catastrophique : garder tout ce que l'on aurait dû oublier.

L'effet « Bulldozer »

L'étude a également révélé quelque chose d'amusant sur la façon dont les gens tentent de corriger ces listes désordonnées. Ils suppriment rarement une ou deux mauvaises règles. Au lieu de cela, ils ont tendance à appuyer sur le bouton « tout supprimer ». Les données ont montré que 76,8 % de toutes les suppressions d'instructions se produisent lors d'une seule « réécriture » géante où quelqu'un supprime la moitié ou plus du fichier d'un coup. C'est comme un jardinier qui ne sait pas quelle mauvaise herbe arracher, alors il brûle tout le jardin et recommence à zéro.

Mais voici le plus étonnant : même après ce « brûlage », le jardin repousse. La liste recommence à croître immédiatement, au même rythme rapide qu'auparavant. C'est ce qu'on appelle l'effet de cliquet. La taille diminue, mais le taux de croissance ne change pas. La cause profonde — le fait que les gens ne se souviennent pas de la raison pour laquelle les règles ont été ajoutées au départ — n'a jamais été corrigée, donc la liste recommence à se remplir à nouveau.

La magie des « commentaires »

Alors, comment empêcher la liste de croître indéfiniment ? Le document suggère une solution que les ingénieurs logiciels utilisent depuis des décennies : les commentaires.

Dans le code informatique classique, les programmeurs écrivent de petites notes à côté de leur code pour expliquer pourquoi ils l'ont écrit de cette façon. Ces notes sont invisibles pour l'ordinateur mais utiles pour le prochain humain qui lira le code. Les chercheurs ont testé si cette même astuce fonctionne pour les prompts d'IA.

Ils ont mis en place une simulation où des « mainteneurs » (des agents d'IA) devaient construire et corriger un prompt. Dans un groupe, ils devaient écrire des instructions sans aucune note. Dans l'autre groupe, ils avaient le droit d'ajouter un commentaire à côté de chaque instruction expliquant la raison. Par exemple, à côté de « Utilise trois paragraphes », le commentaire pourrait être : « Ajouté parce que le robot écrivait quatre paragraphes lors du tour 3. »

Les résultats ont été spectaculaires.

  • Sans commentaires : le prompt est devenu 211,3 % plus grand que la taille minimale parfaite nécessaire pour accomplir la tâche.
  • Avec des commentaires : le prompt est resté presque parfaitement dimensionné, ne croissant que de 1,4 % par rapport au minimum.

Les commentaires ont agi comme une machine à remonter le temps. Ils ont préservé le « raisonnement latent » (la raison cachée) de chaque règle. Lorsqu'un mainteneur consultait la liste plus tard, il pouvait lire le commentaire, comprendre que la règle était toujours nécessaire, ou réaliser qu'elle n'était plus nécessaire, et la supprimer en toute sécurité. Les commentaires ont éliminé 99,3 % des instructions superflues et inutiles.

Est-ce vraiment plus efficace ?

Les chercheurs ne se sont pas contentés de rendre les listes plus courtes ; ils ont vérifié si les robots faisaient réellement un meilleur travail. Ils ont découvert que lorsque les prompts étaient encombrés d'instructions inutiles et bruyantes, les robots s'embrouillaient et commettaient plus d'erreurs. En utilisant les commentaires pour garder la liste propre et ciblée, la capacité des robots à suivre les instructions s'est améliorée jusqu'à 23,1 %.

L'étude a également montré que cela fonctionne même lorsque les instructions sont complexes et que les « mainteneurs » sont des agents d'IA très intelligents. Plus l'IA est capable, plus elle a tendance à ajouter des règles en excès, mais plus elle bénéficie de ces commentaires utiles pour garder le contrôle.

La grande conclusion

Le document conclut par une question ludique mais sérieuse : « Si l'anglais est le nouveau code, pourquoi n'avons-nous pas encore de commentaires ? »

Tout comme les programmeurs humains ont appris il y a longtemps qu'il faut expliquer pourquoi on a écrit une ligne de code, les personnes (et les agents d'IA) qui gèrent ces prompts d'IA doivent commencer à écrire pourquoi ils ont ajouté une règle. Sans cette explication, les règles s'accumulent, le système s'embrouille et les performances chutent. La solution n'est pas d'arrêter d'ajouter des règles ; c'est d'écrire une petite note à côté de chacune d'elles afin que la personne suivante (ou le robot suivant) sache exactement ce qu'il faut garder et ce qu'il faut jeter. Cela transforme un monstre chaotique et grandissant en un outil propre et efficace.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →