← Derniers articles
💻 computer science

Can LLMs Perform Synthesis?

Cette étude démontre que, sur divers domaines de synthèse de programmes, les outils symboliques surpassent ou égalent les performances des LLMs (Qwen et GPT-5) en termes de taux de réussite et de temps d'exécution, même lorsque ces derniers sont exécutés sur du matériel plus puissant.

Auteurs originaux : Derek Egolf, Yuhao Zhou, Stavros Tripakis

Publié 2026-03-24
📖 5 min de lecture🧠 Analyse approfondie

Auteurs originaux : Derek Egolf, Yuhao Zhou, Stavros Tripakis

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Le Grand Défi : Qui est le meilleur architecte ?

Imaginez que vous avez un plan très précis pour une maison (une spécification formelle). Votre but est de construire cette maison exactement selon le plan, sans aucune erreur.

Dans le monde de l'informatique, il existe deux façons de faire :

  1. Les "Architectes Symboliques" (Les outils traditionnels) : Ce sont des robots très rigoureux, des calculatrices géantes qui ne font jamais d'erreur de logique. Ils vérifient chaque brique mathématiquement avant de la poser.
  2. Les "Architectes IA" (Les LLMs comme GPT-5 et Qwen) : Ce sont des génies très créatifs, capables de deviner la solution en quelques secondes, mais qui peuvent parfois faire des erreurs de détail ou inventer des choses qui n'existent pas.

Les chercheurs de l'Université Northeastern se sont demandé : "Si on donne un plan de maison très complexe à ces deux types d'architectes, qui va construire la maison la plus vite et la plus juste ?"

Ils ont testé cette question sur quatre terrains de jeu différents (des domaines de synthèse de programmes) :

  • Les feux de circulation intelligents (Synthèse réactive).
  • Les formules Excel complexes (Synthèse guidée par la syntaxe).
  • Les protocoles de communication entre ordinateurs (Protocoles distribués).
  • Les fonctions mathématiques récursives (Programmes récursifs).

La Méthode de l'Expérience : La course avec un juge

Pour être justes, les chercheurs ont mis en place une course avec des règles strictes :

  • Le Juge (Le Vérificateur) : Personne ne fait confiance aveuglément. À chaque fois qu'un architecte propose une maison, un inspecteur rigoureux (un outil symbolique) vient vérifier si elle tient debout et respecte le plan.
  • La Stratégie de l'IA (Qwen) : Comme l'IA peut faire des erreurs, on lui a donné le droit de réessayer. Si l'inspecteur dit "Non, le toit est de travers", l'IA repart, réfléchit, et propose une nouvelle version. Elle peut le faire jusqu'à ce que le temps soit écoulé (10 minutes). C'est comme un élève qui efface et réécrit son devoir jusqu'à ce qu'il soit parfait.
  • La Stratégie de GPT-5 : C'est le "super-architecte" propriétaire. On lui donne une seule chance de proposer une maison. S'il rate, c'est raté. Mais on lui laisse le temps de bien réfléchir avant de répondre.
  • La Stratégie des Outils Symboliques : Ils travaillent méthodiquement, brique par brique, jusqu'à trouver la solution parfaite.

Les Résultats : Qui a gagné ?

Voici ce que la course a révélé, avec quelques analogies :

1. La Précision (Qui a construit le plus de maisons correctes ?)

  • Les Outils Symboliques sont les champions de la fiabilité. Ils ont réussi à construire le plus de maisons correctes dans tous les domaines. C'est comme un robot qui suit le plan à la lettre : il ne rate presque jamais.
  • GPT-5 (Le géant propriétaire) est très bon. Il a souvent fait aussi bien que les robots, parfois même mieux dans certains cas difficiles. C'est un génie qui a de bonnes intuitions.
  • Qwen (L'open-source) a eu du mal. Bien qu'il ait eu le droit de réessayer des centaines de fois, il a souvent construit des maisons qui ne respectaient pas le plan. Il a tendance à répéter les mêmes erreurs, comme un élève qui écrit "2+2=5" encore et encore même après qu'on lui ait dit que c'est faux.

2. La Vitesse (Qui a fini le plus vite ?)

C'est ici que le choc est le plus fort.

  • Les Outils Symboliques sont des éclairs. Même s'ils tournent sur des ordinateurs "normaux" (des CPU), ils finissent le travail en quelques secondes ou minutes. C'est comme un calculatrice qui trouve la réponse instantanément.
  • Les IA sont lentes. Même si elles tournent sur des super-ordinateurs ultra-puissants (des GPU NVIDIA H200), elles mettent beaucoup plus de temps.
    • Analogie : Imaginez que les outils symboliques sont un train à grande vitesse sur des rails droits. Les IA, c'est comme un Ferrari qui roule dans la boue : la voiture est très puissante, mais elle avance lentement parce qu'elle doit chercher son chemin à chaque instant.

3. Le Problème de la "Boucle de Répétition"

Les chercheurs ont remarqué quelque chose d'amusant avec l'IA (Qwen) : elle a tendance à se répéter.

  • Analogie : Imaginez un chat qui essaie de sortir d'une pièce. Il essaie la porte, elle est fermée. Il essaie la fenêtre, elle est fermée. Il retourne à la porte, l'essaie encore, et encore. L'IA fait pareil : elle propose la même solution incorrecte des dizaines de fois, espérant que cette fois-ci, l'inspecteur aura oublié ou que la solution marchera par magie. Les outils symboliques, eux, ne répètent jamais la même erreur ; ils changent de stratégie intelligemment.

Conclusion Simple

Peut-on utiliser l'IA pour construire des systèmes parfaits ?

  • Oui, mais... L'IA (surtout GPT-5) est un excellent assistant. Elle peut trouver des solutions que les robots traditionnels ne voient pas.
  • Cependant, les outils traditionnels (symboliques) restent les meilleurs pour le travail de précision. Ils sont plus rapides, plus fiables et ne font pas d'erreurs de syntaxe (ils ne posent pas de briques à l'envers).

La leçon à retenir :
Ne remplacez pas l'architecte robot par l'IA seule. La meilleure stratégie est d'avoir les deux : utilisez l'IA pour brainstormer et trouver des idées créatives, mais laissez l'outil symbolique vérifier et finaliser la construction. C'est une équipe gagnante : la créativité de l'humain (ou de l'IA) couplée à la rigueur inébranlable du robot.

En résumé : Les outils symboliques gagnent la course de la fiabilité et de la vitesse, mais l'IA commence à devenir un concurrent sérieux pour trouver des solutions là où les robots bloquent.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →