← Últimos artículos
🤖 AI

Query Circuits: Explaining How Language Models Answer User Prompts

Este artículo introduce los "circuitos de consulta" (query circuits), un método para rastrear el flujo de información específico de la entrada dentro de los modelos de lenguaje para proporcionar explicaciones fieles, dispersas y computacionalmente accesibles para salidas individuales, validadas por una nueva métrica llamada Fidelidad de Desviación Normalizada (NDF) y demostradas a través de múltiples evaluaciones de referencia.

Autores originales: Tung-Yu Wu, Fazl Barez

Publicado 2026-06-02
📖 5 min de lectura🧠 Análisis profundo

Autores originales: Tung-Yu Wu, Fazl Barez

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina un Modelo de Lenguaje Grande (LLM) como una ciudad masiva y bulliciosa con millones de carreteras, intersecciones y semáforos. Cuando le haces una pregunta al modelo (un "prompt"), es como enviar un camión de reparto a través de esta ciudad para entregar una respuesta.

Durante mucho tiempo, los investigadores han intentado entender cómo funciona esta ciudad trazando patrones de tráfico generales. Saben, por ejemplo, que la "Ruta A" siempre se usa cuando la ciudad necesita encontrar un objeto oculto, o que la "Ruta B" se usa para problemas matemáticos. Estos se llaman circuitos de capacidad.

Sin embargo, conocer la ruta general no explica por qué el camión tomó un camino específico para tu entrega específica hoy. Tal vez hubo una zona de obras, un desvío repentino o un semáforo único que solo importó para este viaje en particular.

Este artículo introduce una nueva forma de mirar la ciudad: Circuitos de Consulta (Query Circuits). En lugar de mirar el mapa general, los autores quieren rastrear el camino exacto y diminuto que tomó el camión para tu pregunta específica.

Aquí tienes un desgón de su descubrimiento utilizando analogías sencillas:

1. El Problema: El mapa "Sustituto" estaba equivocado

Previamente, para entender un viaje específico, los investigadores intentaban construir un modelo de la ciudad pequeño y simplificado (un "sustituto") y trazaban la ruta allí.

  • La Analogía: Imagina que intentas entender un atasco complejo en Nueva York construyendo un modelo de juguete de la ciudad con piezas de LEGO. Trazas la ruta en los LEGO, esperando que coincida con la ciudad real.
  • El Problema: El artículo argumenta que estos modelos de LEGO a menudo no coinciden perfectamente con la ciudad real. Omiten detalles y construirlos es lento y costoso. Los autores querían trazar el camino directamente en la ciudad real (el modelo real) sin necesidad de una versión de juguete.

2. La Solución: La lotería "Best-of-N"

Los autores descubrieron que encontrar el camino exacto para una pregunta específica es sorprendentemente difícil. Si solo observas los semáforos para una sola pregunta, los datos suelen ser "ruidosos" (como la estática en una radio), lo que dificulta ver el camino real.

  • La Analogía: Imagina que estás tratando de encontrar un boleto de lotería ganador, pero los números del boleto están ligeramente borrosos. Si intentas elegir al ganador basándote en un solo boleto, podrías elegir el incorrecto.
  • La Solución: Los autores proponen un método llamado Best-of-N (BoN).
    1. Toma tu pregunta original.
    2. Hazle al modelo la misma pregunta pero expresándola de 9 formas diferentes (paráfrasis). Es como preguntar: "¿De qué color es el cielo?" frente a "Describe el color del cielo en un día despejado".
    3. Traza el camino para las 10 versiones.
    4. Elige al ganador: Selecciona el camino que funcionó mejor.
  • El Resultado: Aunque la pregunta original era "borrosa", una de las versiones parafraseadas fue lo suficientemente clara como para revelar el verdadero camino oculto. Al verificar múltiples versiones, encontraron un "boleto ganador" que explica con precisión cómo respondió el modelo.

3. La Nueva Calificación: NDF

Para saber si encontraron el camino correcto, necesitaban una forma de medir el éxito. La calificación antigua (llamada NFS) estaba rota para preguntas complejas; daba puntuaciones como "200%" o "-50%", lo cual no tenía sentido.

  • La Analogía: Es como un velocímetro que a veces dice que vas conduciendo hacia atrás a 100 mph o hacia adelante a 500 mph cuando en realidad vas a 60.
  • La Solución: Inventaron una nueva puntuación llamada NDF (Fidelidad de Desviación Normalizada). Este es un velocímetro confiable que siempre se mantiene entre 0 y 1.
    • 1.0 significa que el camino que encontraron es perfecto (explica la respuesta del modelo exactamente).
    • 0.0 significa que el camino es inútil.
    • Esta nueva calificación les permite confiar en sus hallazgos, incluso en temas difíciles como exámenes médicos o astronomía.

4. La Gran Sorpresa: La Ciudad está mayormente vacía

El hallazgo más emocionante es que, para cualquier pregunta individual, el modelo no utiliza toda la ciudad. Solo utiliza un vecindario pequeño y específico.

  • La Analogía: Podrías pensar que un camión de reparto necesita usar el 50% de las carreteras de la ciudad para ir del punto A al punto B. Pero los autores descubrieron que, para una pregunta específica, el camión solo utiliza aproximadamente el 1.3% de las carreteras.
  • La Prueba: Demostraron que si bloquean el 98.7% de la ciudad y solo permiten que el camión use ese pequeño camino del 1.3%, este aún puede responder la pregunta correctamente aproximadamente el 60% de las veces. Esto demuestra que el "cerebro" del modelo es increíblemente disperso y eficiente para tareas individuales.

Resumen

El artículo presenta una nueva herramienta para explicar exactamente cómo una IA responde a una pregunta específica.

  1. Dejaron de usar "modelos de juguete" y miraron directamente dentro de la IA real.
  2. Se dieron cuenta de que hacer la misma pregunta de diferentes maneras ayuda a revelar la "verdad" oculta de cómo piensa la IA.
  3. Crearon una mejor forma de medir si su explicación es correcta.
  4. Demostraron que, para cualquier pregunta individual, la IA solo utiliza una fracción diminuta y específica de su enorme cerebro para realizar el trabajo.

Esto nos lleva de saber "cómo hace matemáticas la IA en general" a entender "exactamente cómo resolvió la IA este problema matemático".

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →