NICE: Scale-Stable Perturbations for Graph Neural Network Explanations via Noise Corruption
Cet article introduit NICE, un nouveau cadre d'explication pour les réseaux de neurones sur graphes qui remplace le masquage élément par élément, sujet au décalage de distribution, par une corruption par bruit à stabilité d'échelle afin d'éliminer la « dérive d'échelle » et de générer des attributions d'arêtes plus fidèles via une frontière de restauration stochastique.
Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète
Dans le monde de l'intelligence artificielle, il existe une classe croissante de systèmes connus sous le nom de réseaux de neurones sur graphes (Graph Neural Networks). Il ne s'agit pas des outils classiques de reconnaissance d'images que l'on trouve dans votre téléphone ; ils sont au contraire conçus pour comprendre des données qui existent sous la forme d'un réseau de connexions, comme les molécules d'un composé chimique, les réseaux sociaux ou les itinéraires de circulation. Pour prendre une décision, ces systèmes font circuler l'information le long des liens entre les nœuds, un peu comme une rumeur qui se propage dans une foule. Parce que ces systèmes sont incroyablement complexes et que leur logique interne est souvent une boîte noire enchevêtrée, les scientifiques ont développé des « expliqueurs ». Ce sont des outils conçus pour examiner une décision finale et désigner quelles connexions ou quelles informations spécifiques étaient les plus importantes. La méthode standard utilisée par ces outils consiste à jouer au jeu du « et si ». Ils prennent une connexion spécifique, la suppriment ou la réduisent au silence, puis demandent à l'IA : « Votre réponse change-t-elle ? » Si la réponse change radicalement, l'outil suppose que cette connexion était vitale. Cette méthode est la norme de l'industrie depuis des années, mais elle repose sur une hypothèse fragile : celle que l'acte de supprimer une connexion ne casse pas accidentellement l'ensemble du système d'une manière qui n'a rien à voir avec la connexion elle-même.
Une équipe de chercheurs de la Central South University, de la Hong Kong Polytechnic University et de la Griffith University a découvert que cette méthode standard est fondamentalement défectueuse. Ils ont constaté que la manière dont les expliqueurs actuels réduisent les connexions au silence introduit une distorsion cachée qui rend les réponses de l'IA peu fiables. Lorsqu'un expliqueur tente de « couper » un lien dans le réseau, il multiplie généralement l'information circulant à travers ce lien par un nombre proche de zéro. Bien que cela réussisse à arrêter le message spécifique, cela réduit également le volume global d'informations circulant dans l'ensemble du réseau. Les chercheurs appellent ce phénomène la « dérive d'échelle » (Scale Drift). Imaginez une conversation où vous demandez à une personne de chuchoter un secret à un ami, mais qu'en faisant cela, vous forcez accidentellement tout le monde dans la pièce à parler à une fraction de leur volume normal. Le secret a disparu, mais toute la conversation est également devenue faible et déformée. L'IA, recevant ce signal rétréci, peut changer d'avis non pas parce que le secret était important, mais simplement parce que toute la pièce est devenue trop silencieuse pour que l'on puisse entendre quoi que ce soit clairement. Les chercheurs ont démontré que cette dérive s'accumule à chaque étape où l'information traverse le réseau, ce qui signifie que plus le réseau est profond, plus l'état interne de l'IA s'éloigne de la réalité, rendant l'explication peu fiable.
Pour résoudre ce problème, les chercheurs ont proposé une nouvelle façon de tester l'IA qui évite de réduire le signal. Au lieu de simplement réduire une connexion au silence, ils ont introduit une méthode appelée « corruption par le bruit » (Noise Corruption). Plutôt que de baisser le volume à zéro, cette méthode remplace le message clair par une version aléatoire et brouillée qui possède exactement la même force ou « intensité » que l'original. C'est comme prendre une phrase claire et la remplacer par un jaillissement de statique qui est tout aussi fort que la voix originale. L'information est corrompue, mais l'énergie circulant dans le réseau reste stable. En maintenant le volume constant, les chercheurs se sont assurés que tout changement dans la réponse de l'IA était dû à la perte d'un sens spécifique, et non à un effondrement de la puissance globale du système. Ils ont construit un nouveau cadre autour de cette idée, qu'ils ont nommé NICE. Ce système apprend d'abord une limite de la quantité d'informations qui doit être restaurée pour ramener l'IA à sa décision initiale, puis il calcule précisément quelles connexions ont le plus contribué à cette restauration.
Les résultats de cette nouvelle approche ont été significatifs. Testée sur huit benchmarks différents impliquant des molécules chimiques et d'autres structures complexes, la nouvelle méthode a surpassé les meilleurs outils existants. Elle a été capable d'identifier les connexions critiques de manière plus précise, améliorant sa capacité à trouver les bonnes réponses de près de neuf pour cent en moyenne par rapport aux meilleures méthodes précédentes. Plus important encore, les chercheurs ont confirmé que leur nouvelle technique éliminait avec succès le problème de la « dérive d'échelle ». Lorsqu'ils ont comparé l'ancienne méthode de réduction des connexions au silence face à leur nouvelle méthode d'ajout de bruit, l'ancienne méthode poussait systématiquement l'état interne de l'IA loin de sa plage de fonctionnement normale, tandis que la nouvelle méthode maintenait l'état interne de l'IA beaucoup plus proche de son comportement initial avant toute modification. Cela suggère que, pendant des années, de nombreuses explications générées par l'IA ont pu être trompeuses, non pas parce que l'IA était erronée, mais parce que les outils utilisés pour l'expliquer brisaient par inadvertance le système même qu'ils tentaient de comprendre. En corrigeant la façon dont on perturbe les données, les chercheurs ont fourni un moyen plus fidèle de voir à l'intérieur de l'esprit de ces réseaux complexes.
Noyé(e) sous les articles dans votre domaine ?
Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.