← Nieuwste papers
💬 NLP

TraceSIR: A Multi-Agent Framework for Structured Analysis and Reporting of Agentic Execution Traces

TraceSIR is een multi-agent framework dat de analyse van complexe agente uitvoeringstraces vereenvoudigt door gebruik te maken van gespecialiseerde agents voor het comprimeren van data, het diagnosticeren van fouten en het genereren van gestructureerde rapporten, wat leidt tot betere resultaten dan bestaande methoden.

Oorspronkelijke auteurs: Shu-Xun Yang, Cunxiang Wang, Haoke Zhang, Wenbo Yu, Lindong Wu, Jiayi Gui, Dayong Yang, Yukuo Cen, Zhuoer Feng, Bosi Wen, Yidong Wang, Lucen Zhong, Jiamin Ren, Linfeng Zhang, Jie Tang

Gepubliceerd 2026-03-03
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Shu-Xun Yang, Cunxiang Wang, Haoke Zhang, Wenbo Yu, Lindong Wu, Jiayi Gui, Dayong Yang, Yukuo Cen, Zhuoer Feng, Bosi Wen, Yidong Wang, Lucen Zhong, Jiamin Ren, Linfeng Zhang, Jie Tang

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een zeer complexe machine hebt gebouwd, een slimme robot die zelfstandig taken uitvoert, zoals het zoeken op internet, het schrijven van code of het oplossen van raadsels. Soms werkt deze robot perfect, maar soms maakt hij rare fouten of loopt hij vast.

Het probleem is dat wanneer de robot faalt, hij een enorme, onleesbare logboek achterlaat. Dit logboek bevat duizenden regels: wat de robot dacht, welke knoppen hij indrukte, wat hij zag, en wat hij probeerde te doen. Voor een mens is het lezen van dit logboek als proberen een heel boek te lezen in één seconde, terwijl de letters steeds veranderen.

TraceSIR is de oplossing voor dit probleem. Het is een slim systeem dat werkt als een team van drie specialisten om die chaotische logboeken om te zetten in een duidelijk, begrijpelijk rapport.

Hier is hoe TraceSIR werkt, vertaald naar alledaagse taal:

1. Het Probleem: De "Brij" van informatie

Wanneer een AI-agent (zoals een slimme robot) faalt, is de oorzaak vaak erg moeilijk te vinden.

  • Mensen kunnen het niet: Het is te veel werk om handmatig door duizenden regels te bladeren.
  • Slimme computers kunnen het ook niet: Als je de hele logboek direct aan een andere AI geeft, wordt het te lang en raakt de AI in de war (het "vergeet" de belangrijke details of hallucineert).
  • Alleen kijken naar het resultaat helpt niet: Als je alleen kijkt naar "De robot gaf het verkeerde antwoord", weet je niet waarom hij faalde. Misschien zocht hij op het verkeerde woord, of had hij een slechte redenatie.

2. De Oplossing: Het TraceSIR-team

TraceSIR is als een detectivebureau met drie gespecialiseerde detectives die samenwerken om de waarheid boven water te halen.

Detective 1: De "Samenvatter" (StructureAgent)

Stel je voor dat je een lange, rommelige video van een misdaad hebt. De eerste detective pakt die video en knipt alle saaie stukken weg. Hij houdt alleen de cruciale momenten over: Wat dacht de verdachte? Wat deed hij? Wat was het resultaat?

  • Hoe het werkt: Deze agent neemt de enorme logboeken en maakt ze compact. Hij haalt de "ruis" (onnodige tekst) weg, maar zorgt ervoor dat de belangrijke bewijzen (de feitelijke acties) intact blijven. Hij maakt er een strakke, overzichtelijke tabel van.

Detective 2: De "Forensisch Expert" (InsightAgent)

Nu de video kort en duidelijk is, komt de tweede detective. Deze kijkt niet alleen naar het eindresultaat, maar analyseert het gedrag van de robot in detail.

  • Hoe het werkt: Hij vraagt zich af: "Waar ging het fout?" (Misschien zocht de robot op de verkeerde datum?). "Waarom deed hij dat?" (Misschien begreep hij de opdracht niet goed?). "Wat kunnen we verbeteren?" Hij maakt een gedetailleerde diagnose van de fout, inclusief suggesties om het in de toekomst te voorkomen.

Detective 3: De "Verslaggever" (ReportAgent)

Als je maar één robot hebt die faalt, is dat één rapport. Maar als je 50 robots hebt die allemaal op dezelfde manier falen, moet je een groter patroon zien. De derde detective verzamelt alle diagnoses van de vorige twee.

  • Hoe het werkt: Hij kijkt naar alle gevallen en zegt: "Oh, 80% van de robots faalt omdat ze de verkeerde zoekterm gebruiken!" Hij schrijft een compleet, professioneel rapport voor de ontwikkelaars. Dit rapport vertelt niet alleen wat er mis is, maar ook hoe je het kunt fixen.

3. Waarom is dit belangrijk? (De "TraceBench" test)

De makers van TraceSIR hebben een testomgeving gemaakt (ze noemen het TraceBench) met echte, moeilijke taken. Ze hebben getest of hun systeem beter werkt dan bestaande methoden.

Het resultaat? TraceSIR wint het ruimschoots.

  • Bestaande methoden geven vaak vaag antwoorden of kijken alleen naar het eindresultaat.
  • TraceSIR geeft een helder, logisch verhaal: "Hier is de fout, hier is de oorzaak, en hier is de oplossing."

Samenvatting in één zin

TraceSIR is als een slimme vertaler die de onbegrijpelijke, chaotische gedachtes van een robot omzet in een helder, menselijk leesbaar rapport, zodat ontwikkelaars precies weten hoe ze hun robots moeten repareren en verbeteren.

Het maakt het verschil tussen "De robot werkt niet" en "De robot werkt niet omdat hij de instructie 'zoek naar films voor 2015' interpreteerde als 'zoek naar films uit 2015 en later', en hier is hoe we dat fixen."

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →