← Derniers articles
💬 NLP

In Context Learning and Reasoning for Symbolic Regression with Large Language Models

Cette étude démontre que l'utilisation de modèles de langage de grande taille (LLM) comme GPT-4 et GPT-4o, combinée à des techniques d'apprentissage en contexte, de raisonnement par chaîne de pensée et de contraintes scientifiques en langage naturel, permet de découvrir et d'optimiser efficacement des équations symboliques à partir de données, notamment dans des cas complexes comme les modèles d'adsorption et l'écoulement en tuyaux rugueux.

Auteurs originaux : Samiha Sharlin, Tyler R. Josephson

Publié 2026-04-17
📖 5 min de lecture🧠 Analyse approfondie

Auteurs originaux : Samiha Sharlin, Tyler R. Josephson

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

🧠 L'Idée de Base : Donner un crayon à l'IA

Imaginez que vous avez un génie de la lampe (c'est l'Intelligence Artificielle, ou "LLM" comme GPT-4) qui est très fort pour écrire des histoires, traduire des langues et répondre à des questions. Mais ce génie n'a jamais appris à faire des maths complexes ou à découvrir de nouvelles lois de la physique.

Les chercheurs de cet article ont eu une idée brillante : Et si on demandait à ce génie de devenir un détective scientifique ?

Leur mission ? Trouver la formule mathématique cachée derrière un tas de données brutes (par exemple : "Si je mets telle quantité de gaz sur une pierre, combien va-t-elle absorber ?"). C'est ce qu'on appelle la régression symbolique. Au lieu de juste prédire un nombre, l'IA doit trouver l'équation elle-même (comme y=2x+5y = 2x + 5).

🚧 Le Problème : L'IA a tendance à "rêver"

Au début, les chercheurs ont vu quelque chose d'étrange. Quand ils demandaient à l'IA de regarder les données et de donner une formule, l'IA faisait un peu comme un élève qui triche en regardant la réponse dans le livre :

  • Elle inventait des nombres au hasard (elle "hallucinait").
  • Elle donnait une formule qui semblait logique, mais les chiffres ne collaient pas du tout à la réalité.

C'était comme si l'IA dessinait un magnifique pont, mais les piliers étaient en papier et s'effondraient dès qu'on y mettait le poids d'une voiture.

🛠️ La Solution : Le "Brouillon" et le "Co-pilote"

Pour régler ce problème, les chercheurs ont créé une méthode en trois étapes, un peu comme un atelier de réparation :

  1. Le Détective (L'IA) : On donne les données à l'IA, mais on lui dit : "Ne cherche pas les chiffres exacts tout de suite. Regarde la forme, le style, et propose-moi une structure d'équation."
  2. Le Calculateur (Python) : Une fois que l'IA propose une structure (par exemple : "C'est une fraction avec un carré"), un logiciel mathématique très précis (SciPy) prend le relais. Il calcule les chiffres exacts pour que l'équation colle parfaitement aux données.
  3. Le Carnet de Notes (Le "Scratchpad") : C'est l'astuce la plus importante. On demande à l'IA de parler à voix haute avant de donner sa réponse. Elle doit écrire sur un "brouillon" : "Je vois que quand la pression monte, l'absorption ralentit... donc ce n'est pas une ligne droite, c'est une courbe qui s'aplatit."

L'analogie : C'est comme si on demandait à un chef cuisinier (l'IA) de créer un nouveau plat. Au lieu de lui donner juste les ingrédients, on lui demande d'écrire d'abord son plan dans un carnet : "Je vais utiliser du citron pour l'acidité, mais attention, pas trop, sinon ce sera amer." Ensuite, un assistant (le logiciel) ajuste les quantités exactes de sel et de sucre.

🌍 Les Résultats : Des Découvertes Réelles

Les chercheurs ont testé cette méthode sur trois défis :

  • Le Défi Classique (Langmuir) : Une loi connue sur l'adsorption des gaz. L'IA a réussi à retrouver la formule exacte, surtout quand on lui a donné un peu de contexte scientifique (comme : "C'est de l'azote sur de la mica").
  • Le Défi Complexe (Dual-site) : Une situation où deux types de gaz s'adsorbent en même temps. C'est très dur. L'IA a eu du mal, mais avec le "carnet de notes", elle a fini par trouver la bonne structure en comprenant les motifs cachés.
  • Le Mystère (Nikuradse) : Des données sur le frottement de l'eau dans des tuyaux rugueux. Personne ne connaît la formule parfaite. L'IA a proposé de nouvelles équations. Même si elles n'étaient pas parfaites, elles étaient très proches de ce que les super-ordinateurs traditionnels trouvent, mais en utilisant beaucoup moins de calculs.

💡 Pourquoi c'est important ?

Imaginez que vous voulez découvrir une nouvelle loi de la nature.

  • Avant : Il fallait des années de codage complexe, des mathématiciens experts et des supercalculateurs pour chercher dans une "forêt" de milliards de formules possibles.
  • Maintenant : Vous pouvez simplement parler à l'IA en langage naturel. Vous lui dites : "Voici mes données, voici ce que je sais sur la physique du problème, et voici ce que je veux éviter."

L'IA agit comme un traducteur entre votre intuition scientifique et les mathématiques pures. Elle ne remplace pas les mathématiciens, mais elle leur donne un super-pouvoir : elle peut explorer des idées folles et créatives que les logiciels classiques n'oseraient même pas essayer, tout en restant guidée par la logique humaine.

En résumé : Cette recherche montre que si on apprend à bien "parler" à l'IA (en lui donnant des indices, un contexte et un brouillon pour réfléchir), elle peut devenir un partenaire incroyable pour découvrir les secrets cachés dans nos données scientifiques.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →