← Nieuwste papers
🤖 AI

ProtocolBench: Which LLM MultiAgent Protocol to Choose?

Dit artikel introduceert ProtocolBench, een uitgebreide benchmark voor het evalueren van communicatieprotocollen tussen LLM multi-agent systemen op basis van succes, latentie, overhead en robuustheid, naast ProtocolRouter, een leerbaar systeem dat dynamisch optimale protocollen selecteert om de systeemprestaties en betrouwbaarheid aanzienlijk te verbeteren.

Oorspronkelijke auteurs: Hongyi Du, Jiaqi Su, Jisen Li, Lijie Ding, Yingxuan Yang, Peixuan Han, Xiangru Tang, Kunlun Zhu, Jiaxuan You

Gepubliceerd 2026-06-03
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Hongyi Du, Jiaqi Su, Jisen Li, Lijie Ding, Yingxuan Yang, Peixuan Han, Xiangru Tang, Kunlun Zhu, Jiaxuan You

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een enorm team van AI-assistenten bouwt om complexe problemen op te lossen, zoals het schrijven van een roman, het diagnosticeren van een patiënt of het beheren van een toeleveringsketen. Deze AI-agenten moeten met elkaar communiceren om de klus te klaren. Maar net als mensen kunnen ze niet zomaar willekeurig roepen; ze hebben een communicatieprotocol nodig—een set regels voor hoe ze spreken, luisteren en berichten doorgeven.

Momenteel zijn er veel verschillende "talen" of protocollen beschikbaar (zoals A2A, ACP, ANP en Agora). Het probleem is dat het kiezen van de juiste een gokspel is geworden. Ontwikkelaars kiezen vaak op basis van een onderbuikgevoel, zonder te weten welk protocol het snelst, meest betrouwbaar of meest veilig is voor hun specifieke taak.

Dit artikel introduceert twee belangrijke zaken om dit op te lossen: een testomgeving genaamd ProtocolBench en een slimme selector genaamd ProtocolRouter.

1. De Testomgeving: ProtocolBench

Beschouw ProtocolBench als een enorme, gestandaardiseerde "racebaan" voor deze communicatieprotocollen. In plaats van alleen te kijken wie de race wint, meten de onderzoekers vier specifieke zaken om te zien hoe elk protocol presteert onder druk:

  • Hebben ze de klus geklaard? (Taaksucces)
  • Hoe snel deden ze het? (Latentie)
  • Hoeveel "brandstof" (data) hebben ze verbruikt? (Berichtenoverhead)
  • Wat gebeurt er als er dingen kapot gaan? (Robuustheid)

Om dit te testen, hebben ze vier verschillende "scenario's" opgezet (zoals verschillende soorten races):

  • De Detective (GAIA): Een team van agenten die samenwerken om antwoorden te vinden in een enorme bibliotheek met documenten.
  • De Lopende Band (Streaming Queue): Een snel systeem waarbij een coördinator 1.000 vragen naar werkers stuurt die deze snel moeten beantwoorden.
  • De Stormoefening (Fail-Storm): Een simulatie waarbij agenten plotseling "sterven" (de verbinding verliezen) en opnieuw moeten verbinden terwijl het werk doorgaat.
  • De Geheime Agent (Safety Tech): Een medisch scenario waarin agenten moeten communiceren zonder dat iemand kan meeluisteren of hun gegevens kan stelen.

De Grote Ontdekking:
De onderzoekers ontdekten dat er niet één enkel "beste" protocol is. Het hangt er volledig van af wat je doet:

  • Als je snelheid en een laag dataverbruik nodig hebt (zoals de Lopende Band), was ACP de winnaar.
  • Als je hoogwaardige redenering en teamwork nodig hebt (zoals de Detective), presteerde A2A het best.
  • Als je maximale beveiliging en privacy nodig hebt (zoals de Geheime Agent), waren alleen ANP en Agora in staat om de strikte encryptie en identiteitscontroles aan te kunnen.
  • Als je veerkracht nodig hebt wanneer er dingen kapot gaan (zoals de Stormoefening), was A2A het meest betrouwbaar om het gesprek gaande te houden na een crash.

2. De Slimme Selector: ProtocolRouter

Omdat geen enkel protocol overal in wint, hebben de onderzoekers ProtocolRouter gebouwd.

Beschouw dit als een luchtverkeerleiding of een slimme dirigent. In plaats van het hele team te dwingen om dezelfde taal te spreken, kijkt de Router naar elk specifiek deel van de taak en wijst de beste protocol toe voor die specifieke opdracht.

  • Voorbeeld: In een complex project kan de Router de "Researcher"-agenten vertellen om Agora te gebruiken (omdat ze veilig met veel verschillende bronnen moeten communiceren), maar de "Calculator"-agenten vertellen om ACP te gebruiken (omdat ze gewoon zo snel mogelijk cijfers heen en weer moeten sturen).

De Router controleert de regels (bijv. "Moet versleuteld zijn" of "Moet super snel zijn") en kiest het juiste instrument. Het artikel laat zien dat het gebruik van deze slimme selector het systeem 18% sneller kan laten herstellen van crashes en taken succesvoller kan oplossen dan wanneer men simpelweg één protocol voor alles gebruikt.

3. Het "Brug"-concept

Een interessant technisch detail is hoe deze verschillende talen met elkaar communiceren. Wanneer de Router verschillende protocollen aan verschillende agenten toewijst, moeten zij elkaar begrijpen. Het artikel beschrijft een stateless bridge (staatloze brug).

Stel je voor dat twee mensen verschillende talen spreken. Ze hoeven elkaars taal niet te leren; ze gebruiken gewoon een vertaler die de woorden direct omzet. De brug in dit systeem doet precies dat: het vertaalt het berichtformaat van Protocol A naar Protocol B zonder de eigenlijke betekenis van het bericht te veranderen of de boel te veel te vertragen.

Samenvatting

  • Het Probleem: Het kiezen van een AI-communicatieprotocol was een gokspel.
  • De Oplossing: De auteurs hebben een rigoureuze testbaan (ProtocolBench) gebouwd om snelheid, kosten, succes en veiligheid te meten.
  • Het Resultaat: Verschillende protocollen winnen in verschillende situaties. Er is geen "one size fits all".
  • De Innovatie: Ze hebben een ProtocolRouter gecreëerd die automatisch de beste protocol kiest voor elk specifief deel van een taak, waardoor AI-teams sneller, veiliger en betrouwbaarder worden.

Kortom, dit artikel brengt ons van "een protocol kiezen omdat het goed klinkt" naar "een protocol kiezen omdat de data zegt dat het het juiste instrument is voor de klus."

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →