What Should Agents Say? Action-state Communication for Efficient Multi-Agent Systems
Dit artikel introduceert PACT, een geprotocoliseerd actie-toestand communicatiekader dat vrije natuurlijke taaluitwisselingen in multi-agent systemen comprimeert tot compacte records, waardoor het tokengebruik en de inferentiekosten aanzienlijk worden verminderd terwijl de taakprestaties over diverse systeemtopologieën heen gelijk blijven of verbeteren.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Het Probleem: De "Over-sharing" Vergadering
Stel je een team van detectives (agents) voor die een mysterie proberen op te lossen. In huidige systemen schrijft elke detective een enorm verslag en plakt dit in een gedeeld notitieboek zodra hij klaar is met zijn werk, zodat de volgende detective het kan lezen.
Dit verslag bevat:
- De definitieve conclusie.
- De aanwijzingen die ze hebben gevonden.
- Maar ook: Elke willekeurige gedachte die ze hadden, elke doodlopende weg die ze verkenden, elke keer dat ze een aanwijzing opnieuw lazen, en een lange, warrige uitleg over hoe ze dachten.
Het Probleem:
Naarmate het onderzoek vordert, wordt dit gedeelde notitieboek enorm groot.
- Het is duur: Het lezen van een notitieboek van 100 pagina's kost veel geld (in dit geval "tokens" of rekenkracht).
- Het is traag: De volgende detective moet al die ruis lezen voordat hij bij de nieuwe aanwijzingen kan komen.
- Het is verwarrend: De belangrijke feiten raken begraven onder pagina's vol "Ik dacht hieraan, en toen dacht ik aan dat."
Het artikel stelt dat we momenteel toestaan dat agents hun privé-denkproces "over-delen", wat het systeem verstopt.
De Oplossing: PACT (De "Executive Summary" Regel)
De auteurs stellen een nieuwe regel voor genaamd PACT (Protocolized Action-state Communication and Transmission).
Beschouw PACT als een strikte regel voor het gedeelde notitieboek van het team: "Geen gebabbel toegestaan."
In plaats van de hele rommelige conceptversie te plakken, moet een agent zijn werk nu vertalen naar een compact "Action-State Record" met drie delen voordat hij het doorgeeft:
- ACTION (Actie): Wat heb ik net gedaan? (bijv. "Ik heb de database doorzocht.")
- STATE (Toestand): Welk bewijs heb ik gevonden? (bijv. "Ik heb een bonnetje uit 1995 gevonden.")
- RESULT (Resultaat): Wat is de nuttige output? (bijv. "Hier is de afbeelding van het bonnetje.")
De Analogie:
- De Oude Manier: Detective A geeft Detective B een dagboek van 50 pagina's over zijn hele dag, inclusief wat hij als ontbijt heeft gegeten en elke gedachte die hij had tijdens het wandelen naar de winkel.
- De PACT-Manier: Detective A geeft Detective B een briefje met de tekst: "Ik ben naar de winkel gegaan (Actie), heb een bonnetje gevonden voor een blauwe auto (Toestand), en hier is de foto (Resultaat). Controleer nu het auto-register."
Wat Ze Hebben Ontdekt
De onderzoekers hebben dit idee op twee verschillende manieren getest:
- Verdeeld Bewijs: Twee agents moesten aanwijzingen delen om een puzzel op te lossen.
- Lopende Band: Vier agents werkten in een rij (Planner → Critic → Refiner → Solver).
Ze vergeleken PACT met vijf andere manieren van communiceren (zoals het sturen van de volledige tekst, alleen de conclusie, of een korte samenvatting).
De Resultaten:
- Geen "One Size Fits All": Ze ontdekten dat er geen enkele manier van communiceren was die in elke situatie het beste werkte. Soms werkte het sturen van alleen de conclusie goed; soms was het sturen van de volledige tekst prima.
- PACT wint: Echter, PACT was de meest consistente winnaar. Het bespaarde een enorme hoeveelheid "geld" (tokens) terwijl het team net zo slim, of zelfs slimmer, bleef.
- In hun tests verminderde PACT de hoeveelheid verzonden data met gemiddeld ongeveer 39%.
- In real-world coding tools (zoals OpenHands en SWE-agent) verlaagde het het dataverbruik met bijna 50% zonder de code te breken.
Waarom Het Werkt
Het artikel legt uit dat de volgende agent in de keten niet hoeft te weten hoe de vorige agent dacht. Ze hoeven alleen te weten:
- Welke actie is ondernomen.
- Wat de huidige situatie (toestand) is.
- Wat het resultaat is.
Door de "interne monoloog" (het privé-denken) weg te filteren en alleen de "publieke feiten" te delen, wordt het systeem sneller, goedkoper en is de kans kleiner dat het geheugen volloopt.
De Kernboodschap
Het artikel concludeert dat we AI-agents niet zomaar in vrije, ongestructureerde paragrafen moeten laten chatten. In plaats daarvan moeten we ze dwingen een strikt "protocol" te volgen waarbij ze alleen de essentiële updates (Actie, Toestand, Resultaat) delen. Dit verandert een chaotische, dure conversatie in een efficiënte, snelle estafette.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.