← Últimos artículos
🤖 machine learning

Why Does CLAUDE.md Keep Growing? Catastrophic Remembering in Agentic Coding

Este artículo identifica el "recuerdo catastrófico" como la causa del crecimiento ilimitado en los prompts de codificación agéntica como CLAUDE.md, demostrando que anexar instrucciones es económico mientras que eliminarlas es computacionalmente prohibitivo, y propone que incrustar el razonamiento latente en los comentarios del prompt puede detener eficazmente esta divergencia y mejorar significativamente el rendimiento en el seguimiento de instrucciones.

Autores originales: Kushal Chakrabarti

Publicado 2026-08-12
📖 7 min de lectura🧠 Análisis profundo

Autores originales: Kushal Chakrabarti

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina que le estás enseñando a un robot asistente, que es muy inteligente pero un poco olvidadizo, cómo hacer un trabajo específico, como escribir publicaciones de blog o corregir código. Comienzas dándole una lista simple de reglas: "Usa tres párrafos", "No uses la palabra 'muy'" y "Termina siempre con una sonrisa". Esto es un prompt. En el mundo de la inteligencia artificial, estos prompts son como los manuales de instrucciones para los robots.

Ahora, imagina que el robot comete un error. Lo corriges añadiendo una nueva regla: "Está bien, y asegúrate de usar exactamente cinco puntos de enumeración". El robot lo intenta de nuevo, falla, y tú añades otra regla: "Y recuerda capitalizar la primera letra de cada oración". Con el tiempo, esta lista de reglas se vuelve cada vez más larga. En la informática, existe un problema famoso llamado olvido catastrófico, donde un robot aprende algo nuevo y accidentalmente borra su memoria de lo viejo. Pero este artículo habla del problema opuesto: el olvido catastrófico de la memoria (o recuerdo catastrófico). Esto es cuando un robot (o el humano que lo gestiona) sigue añadiendo reglas pero nunca elimina las antiguas, incluso cuando ya no son necesarias. La lista se vuelve tan enorme y desordenada que el robot se confunde, se ralentiza y empieza a cometer errores de nuevo. La gran pregunta es: ¿Por qué esta lista sigue creciendo para siempre y cómo lo detenemos?

El misterio de la lista interminable

El autor de este artículo, Kushal Chakrabarti de South Park Commons, decidió investigar por qué estas listas de instrucciones "agénticas" (archivos que suelen llamarse CLAUDE.md o AGENTS.md en proyectos de software) parecen crecer sin límites. Analizaron casi 1,870 proyectos de software reales en GitHub y rastrearon la vida de más de 247,000 instrucciones individuales.

Encontraron un patrón extraño: estas listas casi nunca se reducen. En su lugar, crecen un promedio de 4.9 nuevas instrucciones por cada actualización del archivo. A lo largo de la vida de un archivo, el número de instrucciones se más que triplica, creciendo un 226%. El archivo promedio termina con 39 instrucciones, pero algunos tienen más de 100.

Los investigadores se preguntaron: ¿Por qué la gente no simplemente borra las reglas viejas y útiles?

Descubrieron que el culpable no es que las reglas sean "obsoletas" (desactualizadas) o que las reglas malas mueran jóvenes. En cambio, el problema es la memoria imperfecta. Piénsalo así: cuando añades una nueva regla a la lista, sabes por qué la añadiste. Tal vez añadiste "Usa tres párrafos" porque el robot seguía escribiendo cuatro. Pero ese "por qué" es solo un pensamiento en tu cabeza. No está escrito.

Con el paso del tiempo y a medida que otras personas editan el archivo, o según cambia el proyecto, esa razón original se desvanece. Si miras la lista seis meses después, ves la regla "Usa tres párrafos", pero no tienes idea de por qué está ahí. ¿Fue porque el robot era demasiado hablador? ¿Fue porque el jefe lo pidió? Sin esa razón, borrar la regla se siente arriesgado. Tienes miedo de que, si la borras, el robot se rompa de nuevo. Así que la dejas ahí. Mientras tanto, sigues añadiendo nuevas reglas para nuevos problemas. El resultado es una lista de reglas inflada y confusa que nadie entiende ya. El autor lo llama recuerdo catastrófico: mantener todo lo que deberías haber olvidado.

El efecto "Bulldozer"

El estudio también encontró algo curioso sobre cómo la gente intenta arreglar estas listas desordenadas. Rara vez borran solo una o dos reglas malas. En su lugar, tienden a pulsar el botón de "borrar todo". Los datos mostraron que el 76.8% de todas las eliminaciones de instrucciones ocurren en un gran "reescritura" donde alguien borra la mitad o más del archivo de una sola vez. Es como un jardinero que no puede decidir qué maleza arrancar, así que simplemente quema todo el jardín y empieza de nuevo.

Pero aquí está el detalle: incluso después de este "incendio", el jardín vuelve a crecer. La lista comienza a crecer de nuevo inmediatamente, al mismo ritmo rápido de antes. Esto se llama el efecto trinquete (o efecto ratchet). El tamaño cae, pero la tasa de crecimiento no cambia. La causa raíz —el hecho de que la gente no pueda recordar por qué se añadieron las reglas en primer lugar— nunca se solucionó, por lo que la lista simplemente comienza a llenarse de nuevo.

La magia de los "comentarios"

Entonces, ¿cómo detenemos el crecimiento infinito de la lista? El artículo sugiere una solución que los ingenieros de software han utilizado durante décadas: los comentarios.

En el código de programación normal, los programadores escriben pequeñas notas junto a su código para explicar por qué lo escribieron de esa manera. Estas notas son invisibles para la computadora pero útiles para el próximo humano que las lea. Los investigadores probaron si este mismo truco funciona para los prompts de IA.

Configuraron una simulación donde "mantenedores" (agentes de IA) tenían que construir y arreglar un prompt. En un grupo, tenían que escribir instrucciones sin ninguna nota. En el otro grupo, se les permitió añadir un comentario junto a cada instrucción explicando la razón. Por ejemplo, junto a "Usa tres párrafos", el comentario podría decir: "Añadido porque el robot escribía cuatro párrafos en la ronda 3".

Los resultados fueron dramáticos.

  • Sin comentarios: El prompt creció hasta ser un 211.3% más grande que el tamaño mínimo perfecto necesario para hacer el trabajo.
  • Con comentarios: El prompt mantuvo un tamaño casi perfecto, creciendo solo un 1.4% más que el mínimo.

Los comentarios actuaron como una máquina del tiempo. Preservaron el "razonamiento latente" (la razón oculta) de cada regla. Cuando un mantenedor miraba la lista más tarde, podía ver el comentario, entender que la regla aún era necesaria, o darse cuenta de que ya no era necesaria, y borrarla de forma segura. Los comentarios eliminaron el 99.3% de las instrucciones innecesarias y excesivas.

¿Realmente funciona mejor?

Los investigadores no se detuvieron solo en hacer las listas más cortas; comprobaron si los robots realmente hacían un mejor trabajo. Encontraron que cuando los prompts estaban inflados con instrucciones inútiles y ruidosas, los robots se confundían y cometían más errores. Al usar comentarios para mantener la lista limpia y enfocada, la capacidad de los robots para seguir instrucciones mejoró hasta en un 23.1%.

El estudio también mostró que esto funciona incluso cuando las instrucciones son complejas y los "mantenedores" son agentes de IA muy inteligentes. Cuanto más capaz es la IA, más tiende a añadir reglas en exceso, pero más se beneficia de tener esos comentarios útiles para mantener el control.

La gran conclusión

El artículo concluye con una pregunta juguetona pero seria: "Si el inglés es el nuevo código, ¿por qué aún no tenemos comentarios?".

Al igual igual que los programadores humanos aprendieron hace mucho tiempo que necesitas explicar por qué escribiste una línea de código, las personas (y los agentes de IA) que gestionan estos prompts de IA deben empezar a escribir por qué añadieron una regla. Sin esa explicación, las reglas se acumulan, el sistema se confunde y el rendimiento cae. La solución no es dejar de añadir reglas; es escribir una pequeña nota junto a cada una para que la siguiente persona (o robot) sepa exactamente qué mantener y qué desechar. Convierte un monstruo caótico y creciente en una herramienta limpia y eficiente.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →