← Derniers articles
🤖 AI

Query Circuits: Explaining How Language Models Answer User Prompts

Cet article introduit les « circuits de requête » (query circuits), une méthode permettant de tracer le flux d'informations spécifique à l'entrée au sein des modèles de langage afin de fournir des explications fidèles, éparses et accessibles sur le plan computationnel pour des sorties individuelles, validées par une nouvelle métrique appelée Fidélité de Déviation Normalisée (NDF) et démontrées à travers de multiples bancs d'essai.

Auteurs originaux : Tung-Yu Wu, Fazl Barez

Publié 2026-06-02
📖 6 min de lecture🧠 Analyse approfondie

Auteurs originaux : Tung-Yu Wu, Fazl Barez

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Imaginez un grand modèle de langage (LLM) comme une ville immense et bouillonnante avec des millions de routes, d'intersections et de feux de signalisation. Lorsque vous posez une question au modèle (un « prompt »), c'est comme si vous envoyiez un camion de livraison à travers cette ville pour déposer une réponse.

Pendant longtemps, les chercheurs ont essayé de comprendre comment cette ville fonctionne en cartographiant des schémas de circulation généraux. Ils savent, par exemple, que la « Route A » est toujours utilisée quand la ville doit trouver un objet caché, ou que la « Route B » est utilisée pour les problèmes mathématiques. Ce sont ce qu'on appelle des circuits de capacités.

Cependant, connaître l'itinéraire général n'explique pas pourquoi le camion a pris un chemin spécifique pour votre livraison spécifique aujourd'hui. Peut-être y avait-il une zone de travaux, un détour soudain ou un feu de signalisation unique qui n'a compté que pour ce voyage précis.

Ce papier introduit une nouvelle façon de regarder la ville : les Circuits de Requête (Query Circuits). Au lieu de regarder la carte générale, les auteurs veulent tracer le chemin exact et minuscule emprunté par le camion pour votre question spécifique.

Voici une décomposition de leur découverte en utilisant des analogies simples :

1. Le Problème : La carte « substitut » était fausse

Auparavant, pour comprendre un voyage spécifique, les chercheurs essayaient de construire un modèle miniature et simplifié de la ville (un « substitut ») et d'en tracer le chemin.

  • L'Analogie : Imaginez que vous essayiez de comprendre un embouteillage complexe à New York en construisant un modèle réduit de la ville à partir de LEGOs. Vous tracez le chemin sur les LEGOs, en espérant qu'il corresponde à la vraie ville.
  • Le Problème : Le papier soutient que ces modèles en LEGO ne correspondent souvent pas parfaitement à la vraie ville. Ils manquent de détails, et les construire est lent et coûteux. Les auteurs voulaient tracer le chemin directement sur la vraie ville (le modèle réel) sans avoir besoin d'une version jouet.

2. La Solution : La loterie du « Best-of-N »

Les auteurs ont découvert que trouver le chemin exact pour une question spécifique est étonnamment difficile. Si vous regardez simplement les feux de signalisation pour une seule question, les données sont souvent « bruitées » (comme des parasites sur une radio), ce qui rend difficile la visualisation du vrai chemin.

  • L'Analogie : Imaginez que vous essayez de trouver un ticket de loterie gagnant, mais que les numéros du ticket sont légèrement flous. Si vous essayez de choisir le gagnant en vous basant sur un seul ticket, vous pourriez choisir le mauvais.
  • La Correction : Les auteurs proposent une méthode appelée Best-of-N (BoN).
    1. Prenez votre question originale.
    2. Posez la même question au modèle mais en formulant la question de 9 manières différentes (paraphrases). C'est comme demander : « Quelle est la couleur du ciel ? » versus « Décrivez la couleur du ciel par une journée claire. »
    3. Tracez le chemin pour les 10 versions.
    4. Choisissez le gagnant : Choisissez le chemin qui a le mieux fonctionné.
  • Le Résultat : Même si la question originale était « floue », l'une des reformulations était assez claire pour révéler le véritable chemin caché. En vérifiant plusieurs versions, ils ont trouvé un « ticket gagnant » qui explique avec précision comment l'IA a répondu.

3. Le Nouveau Scorecard : NDF

Pour savoir s'ils ont trouvé le bon chemin, ils avaient besoin d'un moyen de mesurer le succès. L'ancien scorecard (appelé NFS) était défaillant pour les questions complexes ; il donnait des scores comme « 200 % » ou « -50 % », ce qui n'avait aucun sens.

  • L'Analogie : C'est comme un compteur de vitesse qui vous dirait parfois que vous roulez en marche arrière à 100 mph ou en avant à 500 mph alors que vous roulez réellement à 60.
  • La Correction : Ils ont inventé un nouveau score appelé NDF (Normalized Deviation Faithfulness). C'est un compteur de vitesse fiable qui reste toujours entre 0 et 1.
    • 1.0 signifie que le chemin trouvé est parfait (il explique exactement la réponse du modèle).
    • 0.0 signifie que le chemin est inutile.
    • Ce nouveau scorecard leur permet de faire confiance à leurs découvertes, même sur des sujets difficiles comme les examens médicaux ou l'astronomie.

4. La Grande Surprise : La Ville est principalement vide

La découverte la plus excitante est que, pour n'importe quelle question donnée, le modèle n'utilise pas toute la ville. Il n'utilise qu'un quartier minuscule et spécifique.

  • L'Analogie : Vous pourriez penser qu'un camion de livraison doit utiliser 50 % des routes de la ville pour aller du point A au point B. Mais les auteurs ont découvert que pour une question spécifique, le camion n'utilise qu'environ 1,3 % des routes.
  • La Preuve : Ils ont montré que s'ils bloquaient 98,7 % de la ville et ne laissaient le camion utiliser que ce minuscule chemin de 1,3 %, il pourrait encore répondre correctement à la question environ 60 % du temps. Cela prouve que le « cerveau » du modèle est incroyablement parcimonieux et efficace pour des tâches individuelles.

Résumé

Le papier introduit un nouvel outil pour expliquer exactement comment une IA répond à une question spécifique.

  1. Ils ont arrêté d'utiliser des « modèles jouets » et ont regardé directement à l'intérieur de la véritable IA.
  2. Ils ont réalisé que poser la même question de différentes manières aide à révéler la « vérité » cachée de la façon dont l'IA réfléchit.
  3. Ils ont créé un meilleur moyen de mesurer si leur explication est correcte.
  4. Ils ont prouvé que pour n'importe quelle question, l'IA n'utilise qu'une infime fraction spécifique de son cerveau massif pour accomplir la tâche.

Cela nous fait passer de savoir « comment l'IA fait des maths en général » à comprendre « comment l'IA a résolu ce problème de maths précisément ».

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →