A Unified Definition of Hallucination: It's The World Model, Stupid!
Cet article propose une définition unifiée de l'hallucination comme une modélisation inexacte du monde interne observable par l'utilisateur, arguant que ce cadre englobe les définitions antérieures, clarifie les normes d'évaluation en spécifiant des mondes de référence, et distingue les hallucinations des autres types d'erreurs afin de faciliter de meilleures stratégies d'évaluation et d'atténuation.
Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète
Imaginez que vous jouez à une partie de « Téléphone arabe » avec un robot très intelligent, mais légèrement confus. Vous donnez au robot une histoire, une image ou un ensemble de règles, et vous lui demandez de raconter ce qui s'est passé. Parfois, le robot vous raconte quelque chose qui semble assuré et fluide, mais qui est complètement inventé. Dans le monde de la technologie, nous appelons cela une hallucination.
Mais voici le problème : tout le monde se dispute pour savoir ce qui constitue exactement une hallucination.
- Si un robot résume un article de presse et commet une erreur sur un fait, est-ce une hallucination ?
- Si un robot répond à une question de culture générale tirée de sa mémoire et se trompe, est-ce une hallucination ?
- Si un robot essaie de cliquer sur un bouton sur un site web qui n'existe pas, est-ce une hallucination ?
Certains chercheurs disent « oui » à tout. D'autres disent « non, c'est juste une erreur ». Cette confusion rend difficile la résolution du problème.
Cet article soutient que nous devons arrêter de nous disputer sur la définition et commencer à regarder la cause profonde. Les auteurs proposent une idée simple et unifiée : L'hallucination est simplement un « Modèle de Monde » défectueux.
L'idée centrale : La carte interne du robot
Imaginez le robot comme un explorateur tentant de naviguer dans une ville. Pour ce faire, il a besoin d'une carte (un Modèle de Monde).
- Le Monde de Référence : C'est la carte réelle. C'est la vérité terrain. Cela pourrait être l'article de presse que vous lui avez donné, les vraies règles des échecs, la base de données réelle d'une entreprise ou le code en direct d'un site web.
- La Vue du Robot : C'est ce que le robot est réellement autorisé à voir. Peut-être voit-il l'article entier, ou peut-être n'en voit-il qu'un minuscule fragment.
- La Règle de Conflit : C'est l'arbitre. Si la mémoire du robot dit « Le ciel est vert » mais que l'article dit « Le ciel est bleu », qui gagne ? Généralement, l'article (le Monde de Référence) gagne.
La Définition de l'Article :
Une hallucination se produit uniquement lorsque la sortie du robot contredit le Monde de Référence en se basant sur la Règle de Conflit.
Si le robot dit « Le ciel est vert » et que le Monde de Référence (l'article) dit « Le ciel est bleu », le robot a une carte défectueuse. Il hallucine.
Pourquoi cela unifie tout
Les auteurs montrent que tous les différents types d'« hallucinations » dont les gens parlent sont en réalité la même chose se produisant dans des pièces différentes :
- Résumé : Le « Monde de Référence » est le document source. Si le résumé contredit le document, la carte du robot de ce document est erronée.
- Culture Générale (Open QA) : Le « Monde de Référence » est constitué des faits réels de l'univers (par exemple, qui a remporté le prix Nobel). Si le robot devine mal en se basant sur son entraînement, sa carte interne de la réalité est erronée.
- Navigation Web (Agents) : Le « Monde de Référence » est le code réel du site web (le DOM). Si le robot dit « J'ai cliqué sur le bouton Envoyer » mais que le code montre qu'aucun bouton de ce type n'existe, le robot hallucine un objet qui n'est pas là.
La partie « stupide » : C'est la carte, pas le robot
Le titre dit : « C'est le Modèle de Monde, idiot ! » (It's The World Model, Stupid!). C'est un clin d'œil à un célèbre slogan politique. Les auteurs disent : Arrêtez de blâmer le robot parce qu'il est « confus ». Le problème est que sa carte interne du monde est inexacte.
Parfois, le robot ne « ment » pas ; il regarde simplement la mauvaise carte.
- Erreur de planification : Le robot sait que la carte est correcte, mais il choisit un mauvais chemin. (Ce n'est pas une hallucination).
- Hallucination : Le robot pense que la carte indique « Pont ici », mais la carte indique en réalité « Falaise ». (C'est une hallucination).
Comment réparer (selon l'article)
L'article suggère que nous devrions cesser d'essayer de construire un « robot parfait » et commencer à construire de meilleurs terrains d'essai.
Ils proposent d'utiliser des mondes synthétiques (comme des jeux vidéo ou les échecs) pour tester les robots.
- L'analogie des échecs : Imaginez une partie d'échecs où les règles sont 100 % claires et où l'état du plateau est 100 % connu. Nous pouvons demander au robot : « Est-ce que le cavalier blanc peut sauter sur cette case ? »
- Si le robot répond « Oui » alors que les règles disent « Non », nous savons précisément que sa carte interne de l'échiquier est brisée.
- Comme le « Monde de Référence » (les règles des échecs) est parfaitement défini par un ordinateur, nous n'avons pas besoin d'humains pour deviner si le robot ment. L'ordinateur le sait instantanément.
Pourquoi cela importe
En s'accordant sur cette définition, les chercheurs peuvent enfin :
- Comparer des pommes avec des pommes : Nous pouvons dire si une nouvelle technique réduit réellement les hallucinations ou si elle a simplement changé les règles du jeu.
- Savoir quoi réparer : Si un robot hallucine parce qu'il ne peut pas voir l'intégralité du document, nous réparons la « Vue ». S'il hallucine parce qu'il ignore le document au profit de sa mémoire, nous réparons la « Règle de Conflit ».
- Construire des tests plus vastes : Nous pouvons créer des milliers de scénarios de test (comme des millions de puzzles d'échecs) où nous connaissons la réponse 100 % du temps, sans avoir besoin d'humains pour noter chaque situation.
En bref : L'article dit : « Arrêtez de débattre de ce qu' est une hallucination. C'est simplement quand l'histoire du robot ne correspond pas à la réalité par rapport à laquelle nous avons convenu de le tester. Construisons de meilleures cartes et de meilleurs tests afin de pouvoir réparer la boussole défectueuse du robot. »
Noyé(e) sous les articles dans votre domaine ?
Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.