Shattered Compositionality: Counterintuitive Learning Dynamics of Transformers for Arithmetic
Este artículo revela que los transformadores aprenden habilidades aritméticas a través de una "componibilidad fragmentada" no humana y basada en la correlación, en lugar de reglas procedimentales secuenciales, lo que conduce a errores de mezcla característicos y una robustez deficiente que persiste a pesar del escalado del modelo o la supervisión mediante scratchpad.
Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo
Imagina que le estás enseñando a un robot a resolver un rompecabezas. En el mundo de la inteligencia artificial, estos robots se llaman "Modelos de Lenguaje Extensos" (LLM, por sus siglas en inglés). Son como estudiantes súper entusiastas que han leído casi todos los libros de la biblioteca. Son famosos por ser capaces de escribir historias, depurar código e incluso resolver problemas matemáticos que parecen pertenecer a un libro de texto de secundaria. Pero aquí está el truco: el hecho de que un estudiante pueda sacar una "A" en un examen de práctica no significa que realmente comprenda las reglas del juego. Si cambias el examen solo un poquito —tal vez añadiendo un número extra o reordenando las palabras— el estudiante podría entrar repentinamente en pánico y fallar de formas extrañas e impredecibles. Los científicos llaman a esto "fragilidad". Es como una casa de naipes que se ve perfecta hasta que una suave brisa sopla a través de ella.
Para entender por qué sucede esto, los investigadores observan cómo estos modelos "aprenden" nuevas habilidades. Normalmente, esperamos que aprendan como los humanos: paso a paso, construyendo una base sólida antes de pasar al siguiente nivel. Por ejemplo, al aprender a sumar números, un humano aprende a empezar por el final (el lugar de las unidades), manejar cualquier "acarreo" (donde un número se vuelve demasiado grande para un solo lugar) y luego avanzar hacia las decenas, centenas, y así sucesivamente. Esta es una forma de pensar lógica y jerárquica. Pero, ¿y si el robot aprende las reglas en un orden completamente diferente? ¿Qué tal si aprende los números grandes y aterradores primero y los pequeños después, o intenta aprenderlo todo a la vez? Este artículo se sumerge en ese misterio, utilizando rompecabezas matemáticos simples para observar cómo estos cerebros digitales realmente desarrollan sus habilidades, revelando que podrían estar tomando un atajo que parece aprendizaje, pero que no es exactamente lo mismo que la comprensión humana.
El rompecabezas destrozado: Cómo la IA aprende matemáticas al revés
En este estudio, investigadores de la Universidad de Wisconsin–Madison decidieron dejar de suponer y empezar a observar. Entrenaron modelos de IA pequeños y simples (llamados transformadores) en tareas aritméticas sintéticas —básicamente, haciéndolos practicar la suma y la multiplicación de números una y otra vez—. Pero en lugar de solo verificar si obtenían la respuesta correcta al final, observaron el proceso de aprendizaje en cámara lenta, dígito por dígito. Querían ver cómo los modelos descifraban las reglas.
Lo que encontraron fue algo parecido a observar a un niño intentando ponerse unos zapatos empezando por los cordones y luego tratando de averiguar dónde van los dedos de los pies. Los investigadores descubrieron que estos modelos de IA no aprenden matemáticas de la misma manera que los humanos. En lugar de empezar por la base (el lugar de las unidades) y trabajar hacia arriba, los modelos suelen aprender primero los dígitos más altos.
Imagina que estás sumando cuatro números grandes. Un humano miraría la columna de las unidades, los sumaría, llevaría el exceso a la columna de las decenas, y así sucesivamente. La IA, sin embargo, parecía ignorar la columna de las unidades al principio. Se concentró en los lugares de los miles y los cientos, aprendiendo esos dígitos perfectamente mientras el lugar de las unidades era un desastre. Era como si el modelo estuviera tratando de adivinar el tamaño total del montón antes de saber cuántos artículos individuales había en él. Los investigadores llaman a este fenómeno "componibilidad destrozada" (shattered compositionality). Significa que el modelo está intentando construir una casa de naipes, pero está colocando el techo sobre el suelo y esperando que la base lo alcance más tarde.
El atajo de la "correlación"
¿Por qué haría algo tan tonto una IA súper inteligente? El artículo sugiere que la respuesta reside en cómo la IA observa sus datos de entrenamiento. Los humanos aprenden matemáticas entendiendo la causa y el efecto: "Si sumo estos dos unos, obtengo un diez, así que debo llevar un uno". La IA, sin embargo, parece estar jugando un juego de "ajuste estadístico". Mira los datos y pregunta: "¿Qué números aparecen usualmente juntos?".
Los investigadores descubrieron que los dígitos más altos en la respuesta suelen estar fuertemente vinculados a los dígitos más altos en los números de entrada, independientemente de lo que suceda en los dígitos inferiores. Es un patrón fuerte y fácil de detectar. La IA se aferra a este patrón fácil primero porque es la señal más obvia en los datos. Es como un detective que ve el coche de un sospechoso e inmediatamente asume que es culpable porque tiene un coche rojo, ignorando todas las demás pistas. La IA aprende la regla del "coche rojo" (los dígitos altos) primero porque es la correlación más fácil de encontrar. Solo más tarde, una vez que ha dominado los dígitos altos, intenta descifrar las reglas complicadas y desordenadas para los dígitos inferiores.
Para probar esto, los investigadores realizaron un experimento de "sabotaje". Tomaron los datos de entrenamiento y desordenaron los dígitos del lugar de los miles, haciéndolos aleatorios. De repente, la IA no pudo aprender los dígitos inferiores en absoluto. Se quedó estancada. Esto demostró que la IA no estaba aprendiendo las reglas matemáticas en un orden lógico; estaba dependiendo de los dígitos altos para desbloquear el resto del rompecabezas. Sin los dígitos altos, todo el proceso de aprendizaje colapsó.
El caos del aprendizaje paralelo
El problema se vuelve aún más complicado cuando la IA intenta aprender múltiples habilidades al mismo tiempo. En tareas como ordenar números o compararlos, la IA intenta aprender diferentes reglas en paralelo. Es como un estudiante que intenta aprender a montar en bicicleta, hacer malabares y tocar el piano todo a la vez. A veces, estas habilidades se estorban entre sí.
Los investigadores descubrieron que cuando la IA aprende estas habilidades simultáneamente, crea "errores de mezcla". Imagina que estás ordenando una lista de nombres. Un humano primero revisaría la longitud del nombre, luego la primera letra, luego la segunda. La IA, sin embargo, podría confundirse. Podría tomar la primera letra de un nombre y la última letra de otro, cosiéndolas para crear una palabra nueva y sin sentido. El artículo llama a esto "errores de mezcla". Es como si la IA fuera un chef que ha aprendido a picar cebollas y a trocear zanahorias por separado, pero cuando se le pide que haga una ensalada, accidentalmente lanza la cebolla en el cuenco de la zanahoria y la zanahoria en el de la cebolla, creando una mezcla extraña e incomestible.
Este aprendizaje paralelo crea un sistema frágil. Si le pides a la IA que resuelva un problema que es ligeramente diferente a lo que vio en el entrenamiento —como añadir un número más a la lista—, a menudo se desmorona. Las habilidades que aprendió en paralelo comienzan a pelearse entre sí, y el modelo produce respuestas que son simplemente un desorden de las entradas.
¿Lo arregla ser más grande o más inteligente?
Podrías pensar: "Está bien, tal vez los modelos pequeños están confundidos. ¿Qué pasa con los modelos de IA gigantes y súper poderosos que vemos en las noticias? ¿O qué tal si les damos un 'bloc de notas' para que escriban sus pensamientos, como haría un humano?".
Los investigadores también probaron esto. Entrenaron modelos mucho más grandes (hasta 100 millones de parámetros) e incluso ajustaron un modelo preentrenado masivo (Pythia-1B) en estas tareas matemáticas. También intentaron dar a los modelos un "bloc de notas" donde pudieran escribir los pasos del problema matemático antes de dar la respuesta final.
¿El resultado? Nada cambió.
Incluso los modelos gigantes aprendieron los dígitos en el orden incorrecto. Incluso los modelos con blocs de notas siguieron priorizando los dígitos altos primero y teniendo dificultades con los bajos. Los blocs de notas ayudaron a los modelos a obtener la respuesta correcta más rápido, pero no arreglaron el estilo de aprendizaje subyacente. Los modelos seguían tomando el "atajo de la correlación" en lugar de aprender la verdadera lógica paso a paso de las matemáticas. Esto sugiere que simplemente hacer la IA más grande o darle más herramientas no la hace pensar automáticamente como un humano. La "componibilidad destrozada" parece ser una peculiaridad fundamental de cómo estos modelos aprenden de los datos, no solo un error de un modelo pequeño específico.
La conclusión
Este artículo dibuja la imagen de una IA que es increíblemente capaz pero fundamentalmente diferente a nosotros. Puede resolver problemas que parecen matemáticas humanas, pero lo hace con un conjunto diferente de reglas internas. No sigue un algoritmo lógico y paso a paso; sigue un mapa de patrones estadísticos. Cuando esos patrones son perfectos, la IA brilla. Pero cuando los patrones cambian aunque sea un poco —cuando el problema es ligeramente diferente o los datos son desordenados— el estilo de aprendizaje "destrozado" de la IA hace que tropiece.
Los investigadores no están diciendo que la IA esté rota o sea inútil. Dicen que necesitamos entender cómo aprende para poder confiar mejor en ella. Si queremos que la IA sea confiable en el mundo real, donde los problemas rara vez son perfectos y los datos siempre están cambiando, necesitamos descubrir cómo enseñarle a construir sus habilidades en una jerarquía estable y similar a la humana, en lugar de dejar que aprenda en un apresuramiento paralelo y caótico. Hasta entonces, es posible que tengamos que tener cuidado cuando pidamos a estos estudiantes digitales que resuelvan un problema que es solo un poco diferente de los que practicaron.
¿Ahogado en artículos de tu campo?
Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.