← Últimos artículos
🤖 machine learning

AlgoTrace: Algorithmic Primitives and Compositional Geometry of Reasoning in Language Models

El artículo presenta AlgoTrace, un marco que identifica y manipula primitivas algorítmicas reutilizables dentro del espacio latente de los modelos de lenguaje de gran tamaño, demostrando que el razonamiento de múltiples pasos puede ser dirigido y compuesto mediante operaciones geométricas en estos vectores para mejorar la generalización entre tareas.

Autores originales: Samuel Lippl, Thomas McGee, Kimberly Lopez, Ziwen Pan, Pierce Zhang, Salma Ziadi, Oliver Eberle, Ida Momennejad

Publicado 2026-08-27
📖 5 min de lectura🧠 Análisis profundo

Autores originales: Samuel Lippl, Thomas McGee, Kimberly Lopez, Ziwen Pan, Pierce Zhang, Salma Ziadi, Oliver Eberle, Ida Momennejad

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Los modelos de lenguaje extensos son los motores detrás de la inteligencia artificial moderna, capaces de escribir historias, resolver ecuaciones y navegar por complejos acertijos lógicos. Durante años, los científicos se han preguntado cómo piensan realmente estos sistemas. ¿Simplemente memorizan patrones de sus datos de entrenamiento o realizan un razonamiento genuino y paso a paso? Para responder a esto, los investigadores han comenzado a mirar dentro de los modelos, no en las palabras que producen, sino en las señales matemáticas invisibles que fluyen a través de sus capas internas mientras trabajan. Estas señales, a menudo llamadas activaciones latentes, son la materia prima del pensamiento dentro de la máquina. La pregunta ha sido si estas señales forman un mapa estructurado donde tipos específicos de pensamiento ocurren en lugares específicos, de forma muy similar a cómo diferentes partes del cerebro humano se especializan en diferentes tareas. Si tal mapa existiera, significaría que el razonamiento no es un desenfoque caótico, sino un viaje a través de un paisaje de herramientas mentales distintas y reutilizables.

Un equipo de investigadores ha mapeado ahora este paisaje, revelando que los modelos de lenguaje extensos dependen, de hecho, de un conjunto de bloques de construcción básicos y reutilizables. Llaman a estos bloques de construcción "primitivas algorítmicas". Piense en una primitiva como un paso único y fundamental en un proceso más grande, como encontrar la ciudad más cercana a su ubicación actual al planificar un viaje, o verificar si una ecuación matemática está equilibrada. Los investigadores desarrollaron un nuevo método para rastrear estos pasos a medida que ocurren dentro del modelo. Al observar cómo cambian las señales internas del modelo mientras resuelve problemas difíciles, pudieron agrupar momentos de pensamiento similares. Descubrieron que, cuando el modelo está resolviendo un rompecabezas complejo, se mueve a través de una secuencia de estos estados mentales distintos, de forma muy parecida a un viajero que se desplaza de un pueblo a otro en un mapa.

Para entender lo que estaba sucediendo, el equipo probó los modelos en cuatro tipos de desafíos muy diferentes: encontrar la ruta más corta para un vendedor viajero que visita múltiples ciudades, resolver acertijos lógicos con afirmaciones verdaderas y falsas, abordar problemas difíciles de competencia matemática y navegar a través de un laberinto virtual. Mientras los modelos trabajaban en estas tareas, los investigadores registraron las señales internas en cada paso. Utilizaron un programa informático para agrupar estas señales en grupos, encontrando que ciertos grupos de señales aparecían consistentemente cuando el modelo estaba haciendo cosas específicas, como calcular una distancia o verificar una solución. Luego, utilizaron un sistema automatizado para leer el texto que el modelo estaba escribiendo en esos momentos exactos, confirmando que las señales internas coincidían con las acciones externas. Por ejemplo, un grupo de señales siempre aparecía cuando el modelo elegía la ciudad más cercana para visitar a continuación, mientras que otro aparecía cuando estaba revisando su trabajo.

El descubrimiento más significativo fue que estos bloques de construcción mentales no son solo marcadores pasivos; pueden ser controlados activamente. Los investigadores extrajeron un "vector" específico, que es esencialmente una dirección en el espacio interno del modelo, para cada una de estas primitivas. Luego inyectaron estos vectores de nuevo en el modelo mientras este pensaba. Cuando añadieron el vector de "encontrar al vecino más cercano", el modelo comenzó inmediatamente a usar esa estrategia con más frecuencia, incluso si no era el enfoque más adecuado para el problema específico. Cuando añadieron el vector de "generar un nuevo camino", el modelo comenzó a explorar más opciones. Esto demostró que estas señales internas son la causa directa del comportamiento del modelo. Al encender o apagar un interruptor mental específico, los investigadores pudieron dirigir al modelo para que pensara de manera diferente, sugiriendo que el razonamiento del modelo está compuesto por estas partes distintas y manipulables.

El estudio también mostró que estos bloques de construcción pueden combinarse. Así como se pueden mezclar colores primarios para crear nuevos tonos, los investigadores descubrieron que añadir dos vectores de primitivas diferentes creaba un nuevo comportamiento combinado. Por ejemplo, pudieron tomar un vector que ayudaba al modelo a encontrar el final de un camino y otro que le ayudaba a comparar valores, mezclarlos, y el modelo de repente se volvió capaz de una tarea más compleja que requería ambas habilidades. Esto sugiere que la capacidad del modelo para razonar no es una habilidad única y monolítica, sino una geometría flexible donde operaciones simples pueden ensamblarse en soluciones complejas.

Además, los investigadores compararon un modelo estándar con uno que había sido entrenado especialmente para razonar mejor. Encontraron que el modelo entrenado utilizaba estos bloques de construcción de manera más efectiva. Dependía menos de la adivinación por fuerza bruta y más de pasos estructurados como la verificación y la planificación. El modelo entrenado también mostró una mayor capacidad para transferir estas habilidades de un tipo de problema a otro. Una herramienta mental aprendida mientras se resolvía un problema de matemáticas pudo utilizarse con éxito para ayudar a resolver un rompeculo de navegación. Esto indica que el proceso de entrenamiento no solo enseñó más hechos al modelo, sino que en realidad fortaleció su capacidad para componer y reutilizar estos pasos fundamentales de razonamiento a través de diferentes dominios.

Los hallazgos ofrecen una nueva forma de ver la inteligencia artificial. En lugar de ver estos modelos como cajas negras que producen respuestas por arte de magia, ahora podemos verlos como sistemas que recorren un espacio estructurado de pasos algorítmicos. Los investigadores demostraron que, al comprender la geometría de estos pasos, no solo podemos explicar por qué un modelo comete un error, sino también corregirlo ajustando las señales internas. Este trabajo sugiere que el camino hacia una inteligencia artificial más confiable y capaz reside en enseñar a estos sistemas a componer y generalizar mejor estos bloques de construcción básicos, permitiéndoles resolver problemas que nunca han visto antes mediante la combinación de las herramientas que ya poseen.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →