AI-rithmetic
Este estudio investiga por qué los modelos de IA avanzados fallan en aritmética básica, demostrando que sus errores en la suma de números grandes se deben principalmente a problemas de alineación de operandos relacionados con la tokenización o a fallos en el acarreo de dígitos.
Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo
🧠 El "Efecto Genio Distraído": ¿Por qué la IA gana medallas de matemáticas pero falla en sumas simples?
Imagina que tienes frente a ti a un estudiante que es capaz de escribir poemas profundos, explicar la teoría de la relatividad y resolver problemas de álgebra que dejarían en ridículo a un universitario. Ese estudiante parece un genio absoluto. Pero, de repente, le pides que sume 45 + 78 y... ¡se equivoca! Te da un número que no tiene sentido.
Eso es exactamente lo que está pasando con la Inteligencia Artificial (IA) actual, y un nuevo estudio titulado "AI-rithmetic" lo explica a fondo.
1. El problema: El genio que no sabe contar
Los investigadores de Google descubrieron que, aunque los modelos más avanzados (como GPT-5 o Claude) son increíbles para razonar conceptos complejos, su rendimiento se desploma cuando les pides que sumen números largos.
Es como si la IA fuera un chef de tres estrellas Michelin que puede inventar recetas de alta cocina, pero que de vez en cuando se olvida de cómo usar un cuchillo para cortar una cebolla. No es que no sea inteligente; es que su "mecanismo" para las tareas básicas tiene fallos de diseño.
2. ¿Por qué fallan? Los dos "pecados" de la IA
El estudio encontró que casi todos los errores no son "locuras" aleatorias, sino que se deben a dos errores muy específicos:
El error de "Desalineación" (El efecto de la columna torcida):
Imagina que estás haciendo una suma en un papel cuadriculado. Para que salga bien, los números deben estar perfectamente alineados en sus columnas. La IA, sin embargo, a veces "mueve" un número hacia un lado o hacia otro. Es como si intentaras sumar dos filas de personas, pero una fila estuviera un paso más adelante que la otra. Al final, terminas sumando la nariz de uno con el pie del otro. ¡El resultado es un desastre!El error de "El acarreo olvidado" (El efecto de la memoria de pez):
Cuando sumas, por ejemplo, , escribes el $3$ y "llevas una" al siguiente número. El estudio descubrió que la IA tiene problemas con estos "llevados". A veces, cuando la suma es muy ajustada (como cuando el resultado es 9 o 10), la IA se confunde y decide no llevar nada, o lleva uno cuando no debe. Es como si estuvieras siguiendo una receta y, justo cuando te dicen "añade una pizca de sal", te quedaras mirando al techo y se te olvidara hacerlo.
3. ¿Por qué no se arregla simplemente haciendo la IA "más grande"?
Podrías pensar: "Bueno, si la hacemos más inteligente y le damos más datos, lo arreglará". Pero el estudio dice que no es tan fácil.
El problema no es falta de conocimiento, sino cómo la IA "lee" los números. La IA no ve los números como nosotros (uno por uno), sino que los agrupa en "paquetes" de símbolos (llamados tokens). Es como si intentaras leer un libro, pero en lugar de ver letras, vieras bloques de palabras enteros; si un bloque está mal cortado, toda la frase pierde el sentido.
En resumen...
La IA actual es como un supercomputador con un pequeño tornillo suelto. Es capaz de navegar por las estrellas y entender el lenguaje humano, pero ese pequeño tornillo hace que, cuando la tarea se vuelve repetitiva y mecánica (como sumar números largos), el sistema se desmorone.
El estudio nos enseña que, para llegar a una IA verdaderamente confiable, no basta con hacerla "más grande"; tenemos que enseñarle a construir sus cimientos de forma sólida, para que no sea un genio que se tropieza con su propio pie.
¿Ahogado en artículos de tu campo?
Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.