← Derniers articles
🤖 machine learning

Decomposable Neural Symbolic Regression

Cet article introduit une méthode de régression neuro-symbolique décomposable qui exploite les Multi-Set Transformers, les algorithmes génétiques et la programmation génétique pour distiller des modèles de régression opaques en expressions multivariées précises et interprétables qui récupèrent systématiquement la structure mathématique originale tout en maintenant des performances prédictives compétitives.

Auteurs originaux : Giorgio Morales, John W. Sheppard

Publié 2026-08-25
📖 5 min de lecture🧠 Analyse approfondie

Auteurs originaux : Giorgio Morales, John W. Sheppard

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Dans le monde moderne de la science, les ordinateurs sont devenus des outils incroyablement puissants pour déceler des motifs dans les données. Ils peuvent examiner des milliers de mesures du monde naturel et construire des modèles complexes qui prédisent les résultats futurs avec une grande précision. Ces modèles sont souvent qualifiés d'« opaques » car, bien qu'ils fonctionnent bien, leur logique interne est si emmêlée et compliquée que les humains ne peuvent pas facilement comprendre comment ils parvient à leurs conclusions. Ils sont comme une boîte noire : vous introduisez des données, une réponse en ressort, mais le chemin intermédiaire reste caché. Pour les scientifiques étudiant la physique, la biologie ou l'ingénierie, ce manque de transparence constitue un obstacle majeur. Pour véritablement comprendre l'univers, les chercheurs ont besoin de plus qu'une simple prédiction ; ils ont besoin des équations directrices, les phrases mathématiques claires qui décrivent comment la nature fonctionne. C'est l'objectif de la régression symbolique, un domaine dédié à la recherche de formules simples et lisibles qui expliquent les données observées, plutôt que de simplement les mémoriser.

Une équipe de chercheurs de l'Université d'État du Montana a développé une nouvelle façon de s'attaquer à ce problème, offrant une méthode capable de lever les couches de ces modèles informatiques complexes pour révéler les vérités mathématiques simples qui se cachent en dessous. Leur approche, qu'ils appellent SeTGAP, commence par entraîner un modèle informatique standard et hautement complexe pour apprendre le comportement d'un système. Une fois que ce modèle « opaque » est entraîné et opérationnel, les chercheurs ne tentent pas de rétro-concevoir ses millions de paramètres internes. Au lieu de cela, ils traitent le modèle comme une source de vérité et lui demandent de s'expliquer, une variable à la fois. Ils isolent systématiquement chaque facteur d'entrée, tel que la température ou la pression, et demandent au modèle comment la sortie change lorsqu'un seul de ces facteurs varie. Ce faisant, le système génère une série d'esquisses simples à variable unique qui décrivent la forme de la relation pour chaque pièce du puzzle.

Les chercheurs utilisent ensuite un processus sophistiqué pour assembler ces esquisses individuelles. Imaginez essayer de comprendre une machine complexe en cherchant d'abord comment chaque engrenage tourne de son côté, puis en voyant comment ils s'emboîtent. L'équipe utilise une combinaison d'intelligence artificielle et d'algorithmes évolutionnaires pour fusionner ces esquisses à variable unique en une formule complète à variables multiples. Ils ne se contentent pas de jeter tous les morceaux ensemble en une seule fois, ce qui mène souvent à la confusion et à des résultats trop compliqués. Au lieu de cela, ils ajoutent les variables une par une, en veillant à ce que la structure de la formule reste propre et logique à chaque étape. Cette méthode leur permet de préserver les relations fonctionnelles originales qu'ils ont identifiées au début, empêchant l'équation finale de devenir un enchevêtrement désordonné de chiffres qui correspond aux données mais n'a aucun sens.

Lorsque l'équipe a testé cette méthode contre une grande variété de problèmes, allant de défis mathématiques synthétiques à des équations de physique réelles, les résultats ont été frappants. Sur les problèmes synthétiques, leur méthode a réussi à récupérer la structure mathématique correcte du système sous-jacent dans tous les cas de test qu'ils ont exécutés. En revanche, d'autres méthodes de pointe, y compris celles qui reposent sur l'apprentissage profond ou l'informatique évolutionnaire traditionnelle, ont fréquemment échoué à trouver la forme correcte, produisant souvent des expressions qui étaient soit trop complexes, soit simplement erronées, même si elles prédisaient correctement les nombres. La nouvelle approche s'est révélée particulièrement robuste lorsque les données contenaient du bruit ou des erreurs, un phénomène courant dans les mesures du monde réel. Alors que d'autres méthodes peinaient à se généraliser au-delà des données sur lesquelles elles avaient été entraînées, les équations découvertes par cette méthode ont bien résisté lors de tests sur de nouvelles plages de valeurs inédites.

Les chercheurs ont également appliqué leur technique à une collection célèbre d'équations de physique connue sous le nom de jeu de données Feynman, qui contient des lois décrivant tout, de la gravité au comportement de la lumière. Sur ce test de référence, leur méthode a atteint un taux de réussite élevé dans l'identification des équations correctes, se classant deuxième en matière de récupération de solutions symboliques avec environ 61,2 % de récupérations réussies, et démontrant une performance prédictive compétitive par rapport à de nombreuses techniques établies. L'étude suggère qu'en décomposant un problème complexe en parties plus petites et gérables, puis en les réassemblant soigneusement, il est possible de contourner les limites de l'intelligence artificielle actuelle. Cela ne signifie pas que les ordinateurs sont moins puissants ; cela signifie plutôt que la méthode consistant à leur demander de s'expliquer est plus efficace. Ce travail démontre qu'il est possible d'extraire des lois de la nature claires et lisibles par l'homme à partir des couches profondes et cachées de l'apprentissage automatique moderne, transformant des prédictions opaques en une compréhension transparente.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →