NestyNet. III. Symbolic Regression from Analytic Neural Surrogates
NestyNet-SR est un nouveau cadre de régression symbolique qui exploite des substituts neuronaux analytiques pour décomposer récursivement des données complexes en composantes séparables, lesquelles sont ensuite distillées en expressions exactes sous forme fermée, atteignant ainsi des performances de pointe sur les benchmarks et redécouvrant avec succès des lois physiques fondamentales à partir de données astronomiques réelles.
Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète
La nature cache souvent ses règles les plus simples derrière un voile de complexité. Une loi physique peut ressembler à un nœud inextricable de variables lorsqu'elle est écrite sous forme de données brutes, alors qu'elle pourrait être une phrase unique et élégante si seulement nous savions comment la regarder. Pendant des siècles, les scientifiques se sont appuyés sur l'intuition humaine pour trouver la bonne façon de regarder, pour démêler le nœud et révéler la structure pure qui se trouve en dessous. Mais à mesure que l'univers nous présente des données plus abondantes et des systèmes plus complexes, notre esprit non assisté peine à percevoir le motif. La question est désormais de savoir si les machines peuvent nous aider à explorer un éventail beaucoup plus large de possibilités, en découvrant des relations qui s'ajustent parfaitement aux données et qui pourraient même prédire comment les choses se comportent dans de nouvelles situations que nous n'avons jamais vues auparavant. C'est l'objectif d'un domaine appelé la régression symbolique : la recherche des véritables phrases mathématiques qui décrivent le monde, plutôt que de simplement ajuster une courbe à un graphique.
Le défi est que le nombre de phrases possibles est si vaste que les parcourir une par une est impossible. C'est comme essayer de trouver un livre spécifique dans une bibliothèque où chaque étagère contient toutes les combinaisons de mots possibles. Pour résoudre cela, le chercheur Rodrigo Ibata et son équipe ont développé une nouvelle méthode appelée NestyNet-SR. Au lieu de deviner des phrases au hasard, leur système construit d'abord un modèle hautement précis et flexible des données à l'aide d'un type de réseau de neurones artificiels. Ce modèle agit comme un substitut, un intermédiaire qui connaît intimement les données. L'innovation cruciale est que ce substitut est conçu pour être mathématiquement transparent ; il permet aux chercheurs de calculer exactement comment la sortie change lorsqu'ils modifient les entrées, et ce, jusqu'aux détails les plus fins. En étudiant ces changements, le système peut détecter si les données peuvent être décomposées en parties simples et indépendantes. Il pose des questions telles que : cette partie du système dépend-elle uniquement de la température, tandis que cette autre dépend uniquement de la pression ? Ou existe-t-il une combinaison cachée de variables, comme un rapport spécifique ou une somme, qui rend l'ensemble simple ?
Une fois que le système a identifié ces blocs de construction plus simples, il passe à la seconde étape : la traduction de ceux-ci en un langage lisible par l'homme. C'est ici que la méthode excelle. Elle ne cherche pas seulement une formule parfaite unique ; elle sépare la recherche de la structure de la recherche des nombres. Imaginez essayer de trouver la forme d'une clé sans connaître la taille exacte de ses dents. Le système trouve d'abord la forme — le squelette de l'équation — puis ajuste les nombres précis à celle-ci. Cette approche lui permet de gérer des couches de stratification complexes qui déroutent habituellement les autres méthodes. Il peut découvrir qu'une relation implique une onde sinusoïdale, ou une racine carrée, ou une loi de puissance, et il peut le faire même lorsque les données sont bruitées ou proviennent de plusieurs expériences différentes simultanément. Le système est également strict vis-à-vis de la réalité physique ; il vérifie que les unités de mesure sont cohérentes, s'assurant qu'une formule n'ajoute pas accidentellement des mètres à des secondes.
L'équipe a testé sa méthode sur un ensemble célèbre de 120 équations de physique, connu sous le nom de benchmark AI Feynman, qui sont conçues pour être difficiles à résoudre pour les ordinateurs. Dans un monde sans bruit, le système a réussi à récupérer chacune des 120 équations exactement, une première pour ce type de benchmark. Il y est parvenu en trouvant les coordonnées internes cachées qui rendaient les équations complexes simples. Lorsqu'ils ont ajouté un bruit réaliste aux données, simulant les imperfections des mesures du monde réel, le système a tout de même réussi à trouver la structure correcte pour près de la moitié des problèmes, et il pouvait indiquer aux chercheurs quelles parties de la structure étaient encore fiables. Cette capacité à distinguer une véritable loi d'une chance de réussite est une étape significative en avant.
Pour prouver que la méthode fonctionne sur des données astronomiques réelles, les chercheurs l'ont appliquée à une collection de galaxies spirales issues du relevé SPARC. Ils ont donné à l'ordinateur uniquement les contributions séparées du gaz et des étoiles à la rotation de la galaxie, sans lui dire comment les combiner. Le système a été chargé de trouver la règle qui régit la rotation de ces galaxies. Sans aucune instruction préalable, l'algorithme a découvert que la vitesse de rotation dépend d'une mesure unique et combinée de l'accélération provenant à la fois du gaz et des étoiles. Il a trouvé la manière correcte de peser les étoiles par rapport au gaz, correspondant au rapport masse-luminosité connu des populations stellaires. De plus, il a confirmé que la relation entre le mouvement observé et cette accélération combinée suit une forme spécifique et non unique qui fait débat en astronomie depuis des années. Le système a également fourni une mesure statistique de sa confiance dans la pente de cette relation, montrant que les parties profondes et lentes de la galaxie suivent une règle différente des bords extérieurs rapides.
Ce travail démontre qu'en combinant des substituts mathématiques précis avec une stratégie de recherche hiérarchisée intelligente, nous pouvons passer des données brutes aux lois interprétables de la nature. Le système ne se contente pas de prédire des nombres ; il révèle la structure de l'univers, nous montrant que même dans la danse complexe des galaxies, il existe des règles simples et découvrables si nous savons comment regarder. Les chercheurs ont rendu leur code et leurs données disponibles, permettant à d'autres de tester ces méthodes sur leurs propres problèmes, du mouvement des planètes au comportement des fluides. Le chemin allant d'un réseau de neurones à une équation sous forme fermée n'est plus un mystère ; c'est une voie pratique vers la compréhension des lois fondamentales qui régissent notre monde.
Noyé(e) sous les articles dans votre domaine ?
Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.