← Derniers articles
🤖 AI

What Do Evolutionary Coding Agents Evolve?

Cet article présente EvoTrace, un ensemble de données de traces de codage évolutif, et EvoReplay, une méthodologie fondée sur la rejouabilité, pour révéler que les gains de performance des agents de codage évolutif découlent souvent de mécanismes divers tels que le réajustement ou la réutilisation de connaissances existantes plutôt que d'une véritable innovation algorithmique, comme en témoigne le cyclage déterministe fréquent des lignes de code.

Auteurs originaux : Nico Pelleriti, Sree Harsha Nelaturu, Zhanke Zhou, Zongze Li, Max Zimmer, Bo Han, Sebastian Pokutta

Publié 2026-05-20
📖 5 min de lecture🧠 Analyse approfondie

Auteurs originaux : Nico Pelleriti, Sree Harsha Nelaturu, Zhanke Zhou, Zongze Li, Max Zimmer, Bo Han, Sebastian Pokutta

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Imaginez une équipe de programmeurs d'IA tentant de résoudre un puzzle complexe, comme concevoir une nouvelle méthode pour empiler des cercles dans une boîte ou écrire un moteur de jeu vidéo plus rapide. Au lieu d'une seule personne travaillant seule, ils utilisent un système appelé Codage Évolutionnaire.

Voici comment cela fonctionne : l'IA génère un morceau de code, le teste et observe son score. Ensuite, elle apporte de petits changements (mutations) à ce code, teste la nouvelle version et conserve ceux qui obtiennent de meilleurs résultats. Elle répète ce processus des milliers de fois, « évoluant » le code au fil du temps, tout comme la nature fait évoluer les animaux.

Pendant un certain temps, tout le monde a supposé que ces agents IA découvraient des façons brillantes et entièrement nouvelles de penser pour résoudre des problèmes. Mais cet article pose une question simple et sceptique : « Qu'est-ce qu'ils évoluent réellement ? »

Pour répondre à cette question, les chercheurs ont construit un immense « enregistreur boîte noire » appelé EvoTrace. Pensez-y comme à une boîte noire d'avion pour ces expériences d'IA. Il n'enregistre pas seulement le score final ; il enregistre chaque étape, chaque ligne de code ajoutée ou supprimée, chaque prompt que l'IA a vu, et chaque erreur commise. Ils ont également créé un outil appelé EvoReplay, qui leur permet de mettre l'expérience en pause, de la rembobiner et de demander : « Et si nous changions cette seule chose ? »

Voici les quatre principales découvertes, expliquées avec des analogies du quotidien :

1. Le « Ajusteur » contre l'« Architecte »

Lorsque l'IA obtient un meilleur score, qu'est-ce qui a réellement changé ?

  • La Réalité : La plupart du temps, l'IA n'invente pas une nouvelle stratégie. Elle se contente de régler les boutons.
  • L'Analogie : Imaginez que vous avez une radio. L'IA passe 90 % de son temps à monter ou baisser le volume, ou à ajuster légèrement le cadran de réglage (en changeant un nombre de 1,85 à 1,90). Elle décide rarement de construire une toute nouvelle radio à partir de zéro.
  • La Découverte : Les changements qui entraînent réellement de grands sauts de score (comme ajouter une nouvelle bibliothèque ou réécrire complètement une section de code) sont rares. L'IA consacre la majeure partie de son énergie à de minuscules ajustements ennuyeux.

2. Le « Jardinier Oublieux » (Cyclage)

C'était la découverte la plus surprenante.

  • La Réalité : L'IA continue de supprimer des lignes de code, pour les ajouter à nouveau quelques étapes plus tard.
  • L'Analogie : Imaginez un jardinier qui arrache une mauvaise herbe, s'éloigne, puis revient cinq minutes plus tard pour planter exactement la même mauvaise herbe à exactement le même endroit. Il fait cela encore et encore.
  • La Découverte : Environ 30 % du nouveau code que l'IA ajoute est en fait du code qu'elle avait supprimé plus tôt. C'est comme si l'IA avait une mémoire courte, oubliant ce qu'elle vient de rejeter et perdant du temps à « ré-évoluer » les mêmes idées. Cela se produit dans presque toutes les exécutions, quel que soit le modèle d'IA utilisé.

3. Le « Fantôme dans la Machine » (Reproductibilité)

Si vous demandez à l'IA de résoudre le problème à nouveau en utilisant exactement les mêmes instructions, obtiendra-t-elle le même résultat ?

  • La Réalité : Non.
  • L'Analogie : Imaginez un chef qui prépare une soupe parfaite. Si vous lui demandez de la refaire en utilisant exactement la même recette et les mêmes ingrédients, il préparera une soupe différente. Elle ne ressemblera pas de la même manière, et les ingrédients pourraient être dans un ordre différent.
  • La Découverte : Cependant, même si le code semble différent, la soupe a le même goût. L'IA peut reproduire le score élevé en utilisant un morceau de code complètement différent. Cela signifie que le « score » est réel, mais que la solution spécifique n'est qu'un tirage chanceux parmi d'autres, et non un chef-d'œuvre unique.

4. Le « Simple Régleur » (L'Écart de Réglage)

Quelle part du succès de l'IA consiste réellement à trouver les bons nombres, plutôt qu'à découvrir un nouvel algorithme ?

  • La Réalité : Une énorme partie de l'amélioration provient d'un simple réglage mathématique.
  • L'Analogie : Imaginez une course de voitures. L'IA passe des semaines à construire un nouveau moteur sophistiqué (la structure). Mais les chercheurs ont découvert que s'ils prenaient simplement un moteur médiocre et passaient quelques heures à ajuster le mélange carburant et la pression des pneus (les hyperparamètres), ils pouvaient obtenir presque la même vitesse.
  • La Découverte : Dans de nombreuses tâches mathématiques, un simple programme informatique qui se contente de régler les nombres d'une solution « moyenne » peut égaler, voire surpasser, le score final de la recherche évolutionnaire complexe. L'IA n'a pas nécessairement découvert une nouvelle façon de résoudre le problème ; elle a simplement trouvé les paramètres parfaits pour une ancienne méthode.

La Grande Image

L'article conclut que lorsque nous voyons ces agents IA obtenir de meilleurs scores, nous ne devrions pas automatiquement supposer qu'ils « découvrent une nouvelle science ».

Souvent, ils se contentent de :

  1. Ajuster des nombres (réglage des hyperparamètres).
  2. Oublier et se souvenir du même code (cyclage).
  3. Surapprendre le test (mémoriser les réponses du test plutôt que d'apprendre la leçon).

Les auteurs soutiennent que pour comprendre vraiment si ces agents sont intelligents, nous devons examiner le voyage (la trace), et non seulement la destination (le score final). Nous devons savoir s'ils construisent une nouvelle maison ou s'ils se contentent de réarranger les meubles dans l'ancienne.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →