← Últimos artículos
💻 computer science

Testing History Dependence Between In-Context and In-Weights Learning

Este estudio demuestra que, si bien el orden del entrenamiento (acercarse a una mezcla equilibrada desde diferentes direcciones) crea una diferencia transitoria y mensurable en la fuerza de los mecanismos de aprendizaje en contexto frente a los de pesos, no resulta en una histéresis persistente ni en organizaciones de circuitos causales fundamentalmente diferentes en transformadores pequeños.

Autores originales: Zuo Yuchen

Publicado 2026-08-06
📖 4 min de lectura☕ Lectura para el café

Autores originales: Zuo Yuchen

Artículo original bajo licencia CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina que le estás enseñando a un robot a contar chistes. Puedes enseñarle de dos maneras. Primero, puedes mostrarle algunos ejemplos justo antes de que hable, como una hoja de referencia sobre la mesa. El robot lee la hoja de referencia y deduce el remate basándose en lo que ve en ese mismo instante. Esto se llama Aprendizaje en Contexto (In-Context Learning). Es como si el robot estuviera improvisando sobre la marcha. Segundo, puedes practicar con el robot durante horas hasta que memorice los chistes tan bien que ya no necesite la hoja de referencia. Los chistes ahora están grabados a fuego en su cerebro. Esto es el Aprendizaje en los Pesos (In-Weights Learning).

Durante mucho tiempo, los científicos se preguntaron: si le das al robot exactamente la misma mezcla de hojas de referencia y práctica, ¿siempre resuelve el problema de la misma manera? O, ¿importa cómo llegó allí? ¿Empezó memorizando y luego aprendió a leer la hoja de referencia? ¿O empezó leyendo la hoja de referencia y luego memorizó los chistes? Esta pregunta trata sobre la dependencia de la historia. En el mundo de la física, esto es similar a la histéresis —como un imán que recuerda hacia qué dirección fue tirado, incluso después de dejar de tirar—. Si el cerebro de un robot tiene histéresis, su estado actual no depende solo de lo que está viendo ahora; también depende del camino que recorrió para llegar ahí. Esto es importante porque, si los modelos de IA son así, es posible que no podamos predecir su comportamiento simplemente mirando sus datos actuales; necesitaríamos conocer toda su historia de entrenamiento.

Este artículo toma a un robot pequeño y controlado (un modelo de IA diminuto) y lo somete a una prueba específica para ver si tiene este tipo de "memoria del camino". Los investigadores organizaron un juego en el que el robot tiene que adivinar un código secreto. A veces, el código depende de una pista dada en la oración actual (la hoja de referencia), y otras veces depende de una regla que el robot aprendió hace mucho tiempo (la memoria grabada a fuego). Entrenaron dos copias idénticas del robot para que llegaran exactamente al mismo punto del juego, pero llegaron allí por rutas distintas. Una copia empezó centrándose en las reglas grabadas a fuego y luego cambió lentamente hacia las hojas de referencia. La otra copia empezó con las hojas de referencia y luego cambió lentamente hacia las reglas grabadas a fuego.

Los investigadores descubrieron que, cuando ambos robots llegaban exactamente al mismo punto, no actuaban exactamente igual. El que venía del lado de las "reglas grabadas a fuego" era ligeramente más propenso a usar la hoja de referencia que el que venía del lado de la "hoja de referencia". Era como si el robot que empezó con las reglas todavía estuviera un poco "atascado" en esa mentalidad, aunque ahora estuviera mirando las mismas pistas que el otro robot. Esta diferencia era real y medible: la brecha en su comportamiento era de unos 0,098 puntos en una escala específica, y esto ocurrió en los cinco experimentos de entrenamiento diferentes que realizaron.

Sin embargo, esta memoria del camino era muy efímera. Los investigadores mantuvieron a los robots entrenando en ese mismo punto durante un tiempo más. Tras solo 25 pasos más, la diferencia empezó a invertirse y luego a desaparecer. Para cuando completaron 100 pasos, los dos robots actuaban de forma casi idéntica. El "fantasma" del camino que recorrieron se había desvanecido.

Para entender por qué sucedió esto, los científicos miraron dentro del cerebro del robot. Descubrieron que ambos robots utilizaban exactamente las mismas partes internas para resolver el problema. No cambiaron a un "circuito" diferente o a una nueva forma de pensar. En su lugar, el robot que venía del lado de las "reglas grabadas a fuego" simplemente subió un poco el volumen de la parte de su cerebro que lee la hoja de referencia. Fue un aumento de volumen temporal, no un cambio permanente en el cableado.

Por lo tanto, el artículo sugiere que, si bien los modelos de IA pueden recordar brevemente cómo llegaron a un punto determinado, esto no es una "histéresis" permanente donde se quedan atrapados en estados diferentes para siempre. Es más bien un desfase momentáneo, un exceso rápido que se estabiliza a medida que el modelo continúa aprendiendo. El estudio demuestra que, para comprender verdaderamente el comportamiento de una IA, hay que observar su historia inmediata, pero no hay que preocuparse de que se quedará estancada en un estado extraño para siempre solo por la forma en que fue entrenada. El modelo finalmente se pone al día y olvida el camino, centrándose solo en el destino.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →