← Derniers articles
🤖 machine learning

Deep Variational Inference Symbolic Regression

Ce papier présente la Régression Symbolique Variationnelle Inférentielle Profonde (DVISR), une extension bayésienne variationnelle de la Régression Symbolique Profonde qui infère des distributions a posteriori sur les arbres d'expressions et leurs constantes afin de permettre une régression symbolique évolutive et consciente des incertitudes.

Auteurs originaux : James Butterworth, Gevik Grigorian, Alejandro DiazDelaO

Publié 2026-05-05
📖 5 min de lecture🧠 Analyse approfondie

Auteurs originaux : James Butterworth, Gevik Grigorian, Alejandro DiazDelaO

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Imaginez que vous êtes un détective tentant de résoudre une énigme : vous avez une pile de indices (points de données), et votre objectif est de trouver la formule mathématique exacte qui explique comment ces indices s'assemblent.

La Régression Symbolique est le nom de ce jeu de détective. Contrairement à la régression standard, qui vous force à deviner une forme spécifique pour la formule (comme « cela doit être une ligne droite » ou « cela doit être une courbe »), la régression symbolique dit : « Nous ne connaissons pas encore la forme. Essayons n'importe quelle combinaison de symboles mathématiques (plus, moins, fois, sin, log) jusqu'à ce que nous trouvions celle qui correspond parfaitement aux indices. »

Le Problème avec les Anciens Détectives

L'article discute de deux principales méthodes que les gens ont utilisées jusqu'à présent pour résoudre ce jeu :

  1. Le Détective du « Meilleur Essai » (Régression Symbolique Profonde ou DSR) : Cette méthode utilise une IA intelligente (un réseau de neurones) pour générer des formules. Elle en essaie des milliers et sélectionne la seule « meilleure » qui correspond aux données.
    • Le Défaut : Elle ne vous donne qu'une seule réponse. Si les données sont bruyantes ou désordonnées, le détective peut choisir la mauvaise formule et en être 100 % certain, même s'il a tort. Il ne vous indique pas son degré d'incertitude.
  2. Le Détective « Lent et Régulier » (MCMC) : Il s'agit d'une méthode bayésienne traditionnelle. Au lieu de choisir un seul gagnant, elle tente de cartographier la probabilité que chaque formule possible soit la bonne. Elle vous offre une image complète de l'incertitude.
    • Le Défaut : Elle est incroyablement lente. À mesure que le nombre de formules possibles augmente (ce qui arrive rapidement), ce détective reste bloqué dans les embouteillages et ne peut pas terminer le travail.

La Nouvelle Solution : DVISR

Les auteurs présentent DVISR (Régression Symbolique par Inférence Variationnelle Profonde). Imaginez cela comme un détective surpuissant et accéléré qui combine la rapidité de l'IA avec la vérification de l'incertitude de la méthode bayésienne.

Voici comment cela fonctionne, en utilisant une analogie créative :

1. La « Bibliothèque Infinie » de Formules

Imaginez une bibliothèque contenant chaque formule mathématique possible que vous pourriez jamais écrire. La plupart de ces formules sont absurdes (comme sin(x) + 999). Quelques-unes sont brillantes.

  • L'ancien DSR entre dans la bibliothèque, saisit un livre, vérifie s'il correspond, et s'il est le meilleur jusqu'à présent, il garde ce seul livre et jette le reste.
  • DVISR entre et tente de construire une carte mentale de toute la bibliothèque. Il ne se contente pas de choisir un livre ; il apprend quels livres sont susceptibles d'être la réponse et lesquels ne le sont pas.

2. La « Boussole Magique » (Le Système de Récompense)

Dans l'ancienne méthode d'IA, l'ordinateur était récompensé simplement pour être « proche » des données.
Dans DVISR, l'ordinateur reçoit une nouvelle boussole, plus complexe, appelée ELBO (Limite Inférieure de la Preuve).

  • Au lieu de simplement dire : « Cette formule correspond bien », la boussole dit : « Cette formule correspond bien, ET elle n'est pas trop compliquée, ET elle est cohérente avec ce que nous croyons déjà. »
  • En suivant cette boussole, l'IA apprend à approximer la carte entière des possibilités, et non pas seulement le seul pic optimal.

3. Les « Constantes Métamorphiques »

Dans les formules mathématiques, vous avez souvent des nombres (constantes) qui doivent être ajustés, comme le 2 dans 2x.

  • L'ancien DSR traite ces nombres comme des cadrans fixes. Il trouve une formule, puis passe du temps supplémentaire à tourner les cadrans pour obtenir le nombre parfait.
  • DVISR traite ces nombres comme des nuages. Au lieu de deviner un nombre spécifique (par exemple : « C'est exactement 2,5 »), l'IA devine une distribution (par exemple : « C'est probablement entre 2,4 et 2,6 »). Elle apprend la forme du nuage pour chaque nombre de la formule simultanément.

Qu'ont-ils Démontré ?

Les auteurs ont mené des expériences pour voir si leur nouveau détective fonctionne réellement :

  1. Cas Simples : Ils ont donné à l'IA des énigmes simples (comme y = x au carré).
    • Résultat : L'IA a réussi à construire une carte correspondant parfaitement à la réponse « vraie ». Elle n'a pas seulement trouvé la bonne formule ; elle a correctement calculé la probabilité que la formule soit juste, correspondant exactement aux mathématiques théoriques.
  2. Le Test de la « Grande Bibliothèque » : Ils ont rendu la bibliothèque de formules possibles de plus en plus grande.
    • Résultat : À mesure que la bibliothèque devenait immense, la carte de l'IA devenait légèrement moins parfaite (elle ne pouvait pas capturer chaque détail minuscule), mais elle fonctionnait encore raisonnablement bien pour les problèmes plus petits.
    • La Limite : L'article admet que si les formules deviennent trop longues et complexes, l'IA commence à avoir du mal, tout comme l'ancien détective lent.

La Conclusion

Cet article présente un nouvel outil permettant aux ordinateurs non seulement de trouver la meilleure équation mathématique pour un ensemble de données, mais aussi de quantifier leur propre incertitude.

Au lieu de dire : « La réponse est définitivement y = x^2 », DVISR peut dire : « La réponse est probablement y = x^2, mais il y a une petite chance que ce soit y = x^2 + 0,1, et nous sommes sûrs à 95 % que le nombre 0,1 se situe entre 0 et 0,2. »

Les auteurs concluent que, bien que cela représente une avancée significative pour rendre l'IA plus transparente et fiable, elle doit encore devenir plus rapide et gérer des problèmes beaucoup plus vastes et réels avant de pouvoir être utilisée partout. Ils ont construit le moteur ; maintenant, ils doivent le faire rouler sur l'autoroute.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →