← Ultimi articoli
💬 NLP

Co-Harness: Co-Evolving Harnesses and Model Weights for LLM Agents

Co-Harness è un framework che ottimizza congiuntamente l'harness di runtime di un agente LLM e i parametri del modello attraverso un processo alternato di raffinamento dell'harness e fine-tuning del modello, consentendo il recupero autonomo, guadagni di efficienza e la scoperta di strategie oltre i limiti del post-training a harness fisso.

Autori originali: Zhengyu Chen, Teng Xiao, Huaisheng Zhu, Yige Yuan, Luan Zhang, Jingang Wang

Pubblicato 2026-07-28
📖 3 min di lettura☕ Lettura da pausa caffè

Autori originali: Zhengyu Chen, Teng Xiao, Huaisheng Zhu, Yige Yuan, Luan Zhang, Jingang Wang

Articolo originale sotto licenza CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Questa è una spiegazione generata dall'IA dell'articolo qui sotto. Non è stata scritta né approvata dagli autori. Per precisione tecnica, consulta l'articolo originale. Leggi il disclaimer completo

Immagina di cercare di insegnare a un apprendista brillante ma inesperto come risolvere enigmi complessi. Nel mondo dell'intelligenza artificiale, questo apprendista è un "Large Language Model" (LLM) — un programma informatico capace di leggere, scrivere e ragionare. Ma un LLM non lavora nel vuoto; ha bisogno di una bottega. Questa bottega è chiamata "Harness" (Imbracatura). Pensa all'Harness come al set di strumenti, al manuale di istruzioni, ai parapetti di sicurezza e alla banca dati che l'apprendista usa per svolgere il suo lavoro. Include cose come il modo in cui il computer comunica con una calcolatrice, come ricorda i passaggi precedenti e come sa quando chiedere aiuto.

Per molto tempo, gli scienziati hanno trattato l'apprendista e la bottega come due cose separate. Passavano anni ad addestrare l'apprendista per renderlo più intelligente, ma mantenevano la bottega esattamente la stessa, usando gli stessi vecchi strumenti e le stesse istruzioni progettate a mano. Il problema è che, se la bottega ha un tavolo traballante o una mappa confusa, anche l'apprendista più intelligente inciamperà. Potrebbero fallire non perché non siano abbastanza intelligenti, ma perché l'ambiente in cui lavorano è guasto. Questo articolo pone una domanda semplice ma potente: E se non ci limitassimo ad addestrare l'apprendista, ma sistemassimo anche la bottega nello stesso momento? E se l'apprendista potesse aiutarci a capire cosa c'era di sbagliato negli strumenti e poi potessimo insegnargli usando i nuovi, migliori strumenti?

Questo è esattamente ciò che i ricercatori dietro a Co-Harness hanno scoperto. Hanno creato un sistema in cui il modello di IA e la sua "bottega" (l'Harness) evolvono insieme, come due partner di danza che imparano a muoversi in sincronia. Invece di limitarsi a correggere l'IA sperando nel meglio, il loro sistema analizza ogni volta che l'IA fallisce un compito. Si chiede: "È successo perché l'IA era confusa, o perché lo strumento che stava impugnando era rotto?". Se il problema era lo strumento — ad esempio un'istruzione confusa o un gancio di sicurezza mancante — il sistema corregge automaticamente quello strumento. Poi, utilizza il successo dell'IA con il nuovo strumento per insegnare all'IA come diventare ancora più brava.

I risultati sono come guardare una palla di neve che diventa un masso. I ricercatori hanno testato questo approccio su difficili enigmi matematici e logici. Hanno scoperto che, lasciando che l'IA e i suoi strumenti migliorassero insieme, il sistema diventava significativamente più intelligente. Dopo soli due round di questa "co-evoluzione", l'accuratezza dell'IA nei test matematici difficili è aumentata di oltre 20 punti percentuali in media. In un caso specifico, il sistema è rimasto in funzione per oltre 200 ore senza alcun aiuto umano, correggendo i propri crash, velocizzando il proprio lavoro e persino inventando una nuova strategia di combinazione di più tentativi per ottenere la risposta corretta. Il documento suggerisce che questo approccio a "doppio ciclo" — correggere l'ambiente e addestrare il cervello simultaneamente — è un modo molto più potente per costruire agenti intelligenti rispetto al vecchio metodo di mantenere l'ambiente statico. Si scopre che, per creare un genio, a volte bisogna prima costruire un parco giochi migliore.

Sommerso dagli articoli nel tuo campo?

Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.

Prova Digest →