Taming the Centaur(s) with LAPITHS: a framework for a theoretically grounded interpretation of AI performances
L'article présente le cadre LAPITHS pour remettre en question la validité théorique des affirmations selon lesquelles des modèles d'IA comme CENTAUR possèdent une cognition humaine, soutenant plutôt que leur performance découle de schémas behavioristes plutôt que d'une véritable plausibilité cognitive.
Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète
La Grande Image : Le « Centaure » contre les « Lapithes »
Imaginez une nouvelle intelligence artificielle ultra-intelligente nommée Centaure. Ses créateurs affirment qu'il s'agit d'un « Modèle Unifié de Cognition ». En termes simples, ils disent : « Nous avons appris à cette IA à imiter le comportement humain avec une telle perfection qu'elle doit nécessairement penser comme un humain. Ce n'est pas seulement une calculatrice ; c'est un esprit numérique. »
Les auteurs de ce document, une équipe de chercheurs italiens, disent : « Attendez une minute. »
Ils présentent un cadre appelé LAPITHES (nommé d'après les guerriers grecs anciens qui ont combattu les Centaures). Leur mission est de « dompter » le battage médiatique entourant le Centaure. Ils soutiennent que le fait qu'une IA agisse comme un humain ne signifie pas qu'elle pense comme un humain. Ils veulent séparer le comportement (la performance) de la pensée (la cognition).
Le Problème Central : Le « Sophisme de l'Attribution »
Le document identifie un piège logique appelé le Sophisme de l'Attribution.
L'Analogie :
Imaginez que vous voyez un robot capable d'imiter parfaitement un humain jouant aux échecs. Il déplace les pièces, fait des pauses pour « réfléchir », et commet même les mêmes erreurs qu'un humain lorsqu'il est fatigué.
- Le Sophisme : Vous regardez le robot et dites : « Wow, il doit avoir un cerveau comme celui d'un humain ! Il comprend la stratégie et ressent la pression du jeu. »
- La Réalité : Le robot pourrait simplement être une calculatrice ultra-rapide qui a mémorisé des millions de parties d'échecs. Il ne « comprend » rien ; il prédit simplement le prochain coup basé sur des motifs.
Les auteurs soutiennent que le Centaure est ce robot d'échecs. Il a été entraîné sur un vaste ensemble de données de décisions humaines (appelé Psych-101). Parce qu'il a été entraîné à prédire ce que les humains feraient, il les prédit très bien. Mais les auteurs affirment qu'il ne s'agit que d'imitation comportementale, et non d'alignement cognitif.
L'Outil : La « Grille Cognitive Minimale » (GCM)
Pour prouver leur point, les auteurs ont créé une fiche de notation appelée la Grille Cognitive Minimale (GCM). Imaginez cela comme un « Détecteur de Vérité Cognitive » qui note l'IA sur trois aspects, et non pas seulement sur la qualité de ses réponses.
Structure vs Fonction (Le « Comment ») :
- La Question : L'IA utilise-t-elle les mêmes « engrenages » internes que le cerveau humain ?
- La Découverte : Les humains apprennent de manière incrémentale (essais et erreurs en temps réel) et ont une mémoire de travail limitée (nous ne pouvons retenir que quelques choses dans notre tête). Le Centaure, en revanche, a été entraîné par lots (comme lire un livre entier d'un coup) et possède une immense « fenêtre de contexte » (il peut se souvenir de tout dans une conversation).
- Le Verdict : Le Centaure échoue à ce test. Il agit comme un humain, mais son moteur interne est totalement différent. C'est comme un avion qui vole comme un oiseau, mais qui utilise des réacteurs au lieu de battre des ailes.
Généralité (La « Portée ») :
- La Question : Peut-il effectuer différents types de pensée ?
- La Découverte : Le Centaure est bon en mathématiques, en raisonnement et en langage. Mais il est unimodal, ce qui signifie qu'il ne traite que le texte. Il n'a pas d'yeux pour voir, pas de mains pour toucher, ni de corps pour bouger.
- Le Verdict : Il obtient des points partiels. Il est intelligent, mais il manque de l'expérience « incarnée » d'un humain.
Correspondance de Performance (Le « Résultat ») :
- La Question : Obtient-il la bonne réponse, commet-il les mêmes erreurs et prend-il le même temps ?
- La Découverte : Le Centaure excelle dans ce domaine. Il prédit les choix humains presque parfaitement et imite même les schémas d'erreurs humaines.
- Le Verdict : Score élevé ici. Mais les auteurs mettent en garde : Un score élevé ici ne prouve pas qu'il pense comme nous.
Le Score Final : Lorsque vous combinez ces éléments, le Centaure obtient un faible score de « Plausibilité Cognitive ». C'est un excellent émulateur (un acteur parfait), mais un mauvais modèle cognitif (un véritable penseur).
L'Expérience : « N'importe Qui Peut-il Faire Cela ? »
Pour prouver que le Centaure n'est pas spécial, les chercheurs ont mené un test. Ils ont pris cinq autres modèles d'IA puissants (comme GPT-4, Gemini et d'autres) qui n'avaient PAS été entraînés sur les données humaines.
Ils ont donné à ces modèles une instruction simple : « Voici la règle du jeu. Voici l'historique de ce qui s'est passé. Maintenant, que ferait un humain ? » (Ceci est appelé RAG ou Génération Augmentée par Récupération).
Le Résultat :
- Ces modèles « non entraînés » ont performé presque aussi bien que le Centaure.
- Dans certains cas, la différence de performance était si faible qu'elle était statistiquement insignifiante.
- La Métaphore : C'est comme donner un script à un groupe d'acteurs. Le Centaure est l'acteur qui a mémorisé le script parfaitement. Mais lorsque vous donnez le même script à d'autres acteurs, ils peuvent aussi délivrer les répliques presque parfaitement sans avoir mémorisé tout le livre à l'avance.
Conclusion : Vous n'avez pas besoin d'un modèle cognitif « spécial » pour imiter le comportement humain ; il vous suffit d'un modèle linguistique intelligent et des bonnes instructions.
Le Test de Scan Cérébral (IRMf)
Les créateurs du Centaure ont affirmé qu'après l'entraînement, les « pensées internes » de l'IA (représentations neuronales) ont commencé à ressembler à des scans cérébraux humains (données IRMf). Ils ont dit que cela prouvait que l'IA devenait « semblable au cerveau ».
Les auteurs ont également testé cela. Ils ont demandé à d'autres modèles d'IA de deviner à quoi ressemblerait l'activité cérébrale pour une tâche spécifique, simplement en lisant la description de la tâche.
Le Résultat :
- Les autres modèles ont également produit des prédictions qui corrélait fortement avec les scans cérébraux humains.
- La Métaphore : Si vous demandez à un groupe de personnes de décrire le sentiment de « peur », elles pourraient toutes utiliser des mots similaires (cœur qui bat, transpiration). Cela ne signifie pas qu'elles ont toutes exactement le même mécanisme biologique de peur ; cela signifie simplement qu'elles décrivent toutes le même concept.
- Les auteurs soutiennent qu'une forte corrélation dans les scans cérébraux est plus facile à obtenir que ce que les créateurs admettent. Cela ne prouve pas que l'IA a un cerveau ; cela prouve simplement qu'elle comprend le concept de la tâche.
La Conclusion Finale
Le document se termine par un avertissement pour le monde de l'IA :
- Ne confondez pas la carte avec le territoire. Juste parce qu'une IA dessine une carte parfaite du comportement humain (prédit ce que nous faisons), cela ne signifie pas que l'IA est le territoire (l'esprit humain).
- Le Centaure est un excellent prédicteur, mais une faible explication. C'est un outil fantastique pour deviner ce que les humains feront ensuite. Mais nous ne pouvons pas l'utiliser pour expliquer pourquoi les humains pensent comme ils le font, car sa machinerie interne est fondamentalement différente de la nôtre.
- Nous avons besoin de meilleurs tests. Nous devons arrêter de simplement demander « A-t-il obtenu la bonne réponse ? » et commencer à demander « A-t-il obtenu la bonne réponse en utilisant les mêmes engrenages mentaux qu'un humain ? »
En bref : Le Centaure est un acteur magistral, mais ce n'est pas un humain. Les auteurs ont construit un cadre (LAPITHES) pour s'assurer que nous ne sommes pas trompés par la performance.
Noyé(e) sous les articles dans votre domaine ?
Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.