Can One Agent Restore Another? Multi-Agent Verification Through Independent Constraint Sources
Questo studio dimostra che, mentre i modelli linguistici più grandi possono recuperare indipendentemente da istruzioni contrastanti, un agente accoppiato più piccolo può ripristinare il comportamento di un partner perturbato solo quando la cronologia del partner non contiene l'istruzione contrastante, fornendo prova del fatto che l'affidabilità distribuita nei sistemi multi-agente derivi da fonti di vincolo parzialmente indipendenti piuttosto che dal mero volume di generazione.