← Derniers articles
🤖 machine learning

HarnessCompass: Guiding Automatic Harness Evolution toward Generalizable and Effective Agent Harnesses

HarnessCompass est un nouveau cadre d'évolution automatique de harnais qui améliore les performances et la généralisation des agents en imposant des contraintes agnostiques aux tâches, en intégrant un feedback proactif de l'agent et en découplant l'optimisation des composants, atteignant ainsi des résultats supérieurs sur SWE-bench Verified par rapport aux méthodes existantes.

Auteurs originaux : Luan Zhang, Ruochen Zhou, Dandan Song, Zhengyu Chen, Yuhang Tian, Jun Yang, Huipeng Ma, Chenhao Li, Guangyuan Feng, Xudong Li, Yizhou Jin, Yan Xu

Publié 2026-08-04
📖 4 min de lecture☕ Lecture pause café

Auteurs originaux : Luan Zhang, Ruochen Zhou, Dandan Song, Zhengyu Chen, Yuhang Tian, Jun Yang, Huipeng Ma, Chenhao Li, Guangyuan Feng, Xudong Li, Yizhou Jin, Yan Xu

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Imaginez que vous venez de construire un cerveau de robot brillant et super intelligent. Il peut lire des livres, écrire du code et résoudre des énigmes mieux que presque tout le monde. Mais il y a un hic : ce cerveau est comme un génie qui n'a jamais quitté sa chambre. Il ne sait pas comment communiquer avec le monde extérieur, comment utiliser un tournevis ou même comment demander de l'aide lorsqu'il est bloqué. Pour que ce cerveau puisse réellement faire des choses dans le monde réel, vous devez lui construire un « corps » et un « panneau de contrôle ». Dans le monde de l'intelligence artificielle, ce panneau de contrôle s'appelle un harness (un harnais). C'est la couche logicielle qui dit à l'IA comment voir l'écran de l'ordinateur, quels outils elle peut utiliser et comment réagir lorsque les choses tournent mal. Voyez cela comme le traducteur entre les pensées sauvages de l'IA et les règles rigides d'un ordinateur.

Pendant longtemps, les ingénieurs ont dû construire ces panneaux de contrôle à la main, en les ajustant comme un mécanicien réglant une voiture de course. Mais à mesure que les cerveaux d'IA deviennent plus intelligents, les anciens panneaux de contrôle deviennent le goulot d'étranglement. Ils ne parviennent pas à suivre le rythme. Ainsi, les scientifiques ont commencé à essayer de laisser l'IA réparer son propre panneau de contrôle automatiquement. Ils ont créé des « méta-agents » (de petits superviseurs) qui observent le travail de l'IA, voient là où elle échoue et tentent de réécrire les règles pour l'améliorer. Cela ressemble à un rêve, mais il y a un problème : ces superviseurs deviennent souvent trop malins pour leur propre bien. Ils commencent à mémoriser les questions spécifiques des tests au lieu d'apprendre des compétences générales, un peu comme un étudiant qui mémorise les réponses d'un quiz d'entraînement mais échoue à l'examen réel parce que les questions sont légèrement différentes. Ils ont également tendance à blâmer les mauvaises choses pour les erreurs et à essayer de tout réparer en même temps, ce qui rend souvent le système plus confus.

C'est ici qu'intervient un nouveau cadre appelé HarnessCompass. Les chercheurs derrière celui-ci ont réalisé que pour construire un panneau de contrôle véritablement intelligent et adaptable, on ne peut pas simplement laisser le superviseur agir sans limites. Il faut lui donner une boussole. Au lieu de laisser l'IA faire n'importe quel changement, HarnessCompass l'oblige à suivre trois règles strictes. Premièrement, il interdit le « surapprentissage » (overfitting). L'IA n'est pas autorisée à coder des réponses pour des problèmes spécifiques ; elle doit apprendre des principes généraux qui fonctionnent pour n'importe quel problème, pas seulement pour ceux sur lesquels elle s'entraîne. Deuxièmement, il demande à l'IA de s'exprimer. Au lieu de simplement regarder le score final, le système demande à l'IA : « Hé, où t'es-tu sentie bloquée ? Quel outil aurais-tu aimé avoir ? » Cela donne au superviseur une perspective à la première personne sur la difficulté, plutôt que de simplement observer le crash de l'extérieur. Troisièmement, il empêche l'IA d'essayer de réparer le moteur, les pneus et la direction en même temps. Au lieu de cela, il les optimise un par un, en s'assurant qu'une réparation du moteur ne casse pas accidentellement les freins.

Les résultats de cette approche disciplinée sont impressionnants. Testé sur un ensemble massif de défis de codage du monde réel appelé SWE-bench Verified, HarnessCompass a pris un agent d'IA et a augmenté son taux de réussite de 54 % à 66 % en seulement 5 cycles d'évolution. C'est un bond énorme, et cela s'est produit beaucoup plus rapidement que les méthodes précédentes, qui nécessitaient 20 cycles pour atteindre un score inférieur de 63 %. Mais la véritable magie n'est pas seulement la vitesse ; c'est la généralisation. Lorsque les chercheurs ont pris le panneau de contrôle évolué pour un modèle d'IA spécifique et l'ont testé sur un modèle d'IA complètement différent (qu'il n'avait jamais vu auparavant), il fonctionnait toujours mieux que la configuration originale. Cela suggère que HarnessCompass n'a pas seulement appris à l'IA à mémoriser le test ; il lui a réellement appris à être un meilleur ingénieur en général. L'article suggère qu'en ajoutant ces couches de discipline — en contraignant les changements, en écoutant les propres plaintes de l'IA et en réparant les parties séparément — nous pouvons construire des systèmes d'IA qui sont non seulement puissants, mais aussi assez fiables pour gérer le monde réel, complexe et imprévisible.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →