← Nieuwste papers
🤖 AI

Declarative Skills for AI Agents in Knowledge-Grounded Tool-Use Workflows

Dit artikel betoogt dat declaratieve agenten, die gebruikmaken van natuurlijke taal-skillfiles voor orchestratie, rigide imperatieve toestandsmachines overtreffen in kennisgegronde tool-use workflows door de nauwkeurigheid te verbeteren en fouten te verminderen, mits hoogwaardige retrieval beschikbaar is om de dominante flessenhals van onvolledige bewijsvoering te overwinnen.

Oorspronkelijke auteurs: M. Danish Lim, I. Danial Bin Sharudin, Wen Han Chen, Cedric Lim, Laura Wynter

Gepubliceerd 2026-06-08
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: M. Danish Lim, I. Danial Bin Sharudin, Wen Han Chen, Cedric Lim, Laura Wynter

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een nieuwe assistent aanneemt om je bankrekening te beheren. Je hebt een enorme, rommelige bibliotheek vol regelboeken, beleidsdocumenten en handleidingen (de "Kennisbank"). Je doel is om de assistent specifieke taken te laten uitvoeren, zoals het sluiten van een rekening of het betwisten van een afschrijving, door de juiste regels te vinden en de juiste tools te gebruiken.

Dit artikel is een race tussen drie verschillende manieren om deze assistent aan te sturen om te zien welke er daadwerkelijk in slaagt de taak te volbrengen.

De Drie "Managers"

De onderzoekers testten drie verschillende managestijlen voor hun AI-assistent:

1. De "Nakte" Assistent (Baseline)
Dit is de assistent zonder speciale instructies. Je geeft ze simpelweg de ruwe gesprekshistorie en zegt: "Zoek het maar uit." Ze moeten zelf de volgorde van handelingen bedenken, onthouden om de identiteit te verifiëren en de juiste tools vinden.

  • Analogie: Een toerist een kaart van een vreemde stad geven zonder gids en zeggen: "Vind het museum en koop een kaartje."

2. De "Declaratieve" Assistent (De Skill-File Manager)
Deze assistent krijgt een reeks "Skill Files" — eenvoudige cheat sheets in natuurlijke taal (zoals Markdown-documenten) die aan hun instructies zijn gekoppeld. Deze bestanden dwingen de assistent niet om een rigide pad te volgen; in plaats daarvan zeggen ze dingen als: "Hey, voordat je een rekening sluit, moet je controleren of er geen lopende geschillen zijn," of "Zoek altijd eerst in de bibliotheek als je de naam van de tool niet weet." De assistent leest deze bestanden en beslist hoe te handelen op basis van de informatie.

  • Analogie: De toerist een gids geven met uitgelichte tips: "Vergeet niet om naar het verkeer te kijken voordat je gaat rijden," en "Vraag om de weg als je verdwaald bent." De toerist rijdt nog steeds de auto, maar heeft wel beter advies.

3. De "Imperatieve" Assistent (De State-Machine Manager)
Deze assistent wordt aangestuurd door een strikt, door de computer geprogrammeerd stroomdiagram. De manager dwingt de assistent door specifieke fasen: Begroeting → Triage → Verificatie → Planning → Uitvoering. De assistent kan niet overgaan naar de fase "Uitvoering" (het daadwerkelijke bankieren doen) totdat de computer heeft bevestigd dat de fase "Verificatie" is doorlopen. De computer regelt de verkeerslichten; de assistent rijdt alleen als het licht op groen staat.

  • Analogie: De toerist in een zelfrijdende auto plaatsen met een rigide route geprogrammeerd in de GPS. De auto moet bij elk rood licht stoppen en kan niet linksaf slaan tenzij de GPS dat zegt. De bestuurder (de AI) heeft geen vrijheid om af te wijken.

De Grote Ontdekking: De "Bibliotheek" is de Bottleneck

De onderzoekers ontdekten een verrassende waarheid: het maakt niet uit hoe goed je manager is als de bibliotheek een rommeltje is.

  • De "Gouden" Bibliotheek: Wanneer de onderzoekers de assistenten de exacte juiste documenten gaven die ze nodig hadden (perfecte informatie), was de Declaratieve Assistent (met de skill files) de duidelijke winnaar. Het maakte minder fouten en voerde de taken vaker correct uit. De "Nakte" assistent deed het oké, maar de "Imperatieve" assistent deed het zelfs slechter, omdat de rigide regels te broos waren; als de AI een stap verkeerd classificeerde, liep het hele systeem vast of faalde het.
  • De "Ruisende" Bibliotheek: Wanneer de onderzoekers een standaard zoektool gebruikten die vaak de verkeerde documenten terugbracht (ruisende retrieval), faalde iedereen. De skill files konden het niet oplossen dat de assistent de verkeerde regels las. Het rigide stroomdiagram kon ook niet helpen omdat de AI fouten maakte op basis van slechte informatie.

De Les: Als je AI op zoek is naar informatie in een rommelige, ongestructureerde database, kan geen enkele slimme managementvorm (skill files of rigide code) het redden. Je hebt eerst betere zoektools nodig.

De "Compliance" Mythe

De onderzoekers wilden zien of de Imperatieve Assistent (het strikte stroomdiagram) beter was in het volgen van veiligheidsregels, zoals "Verifieer de ID van de gebruiker voordat je hun account wijzigt."

  • De Theorie: Het strikte stroomdiagram zou de AI dwingen om de identiteit te verifiëren voordat deze de account mag aanraken.
  • De Realiteit: Het werkte niet. De AI maakte nog steeds fouten. Omdat de AI in de war was door de rommelige informatie, "hallucineerde" hij soms dat hij de verificatiestap wel had doorlopen, of het rigide stroomdiagram raakte in de war door de fouten van de AI. De strikte regels hielden de AI niet echt tegen om ongeautoriseerde wijzigingen aan te brengen. Sterker nog, het rigide systeem was eerder geneigd om in loops te raken, waarbij het steeds opnieuw probeerde te falen, wat tijd en geld verspilde.

Samenvatting van de Resultaten

  1. Skill Files Werken (Wanneer de info goed is): De AI voorzien van natuurlijke taal "cheat sheets" (Declaratief) helpt het beter presteren dan een naakte AI, vooral als het AI-model zelf niet superintelligent is.
  2. Rigide Code is Broos: De AI in een strikt stapsgewijs stroomdiagram dwingen (Imperatief) maakte het niet veiliger of nalevender. Het maakte het systeem zelfs fragieler en gevoeliger voor fouten wanneer zaken niet precies volgens plan verliepen.
  3. Zoeken is Koning: Het grootste probleem was niet hoe de AI werd aangestuurd; het was of de AI de juiste informatie kon vinden. Als de zoekresultaten slecht zijn, zal geen enkele managementstijl de taak redden.

Kortom: Als je wilt dat je AI-agent goed is in complexe taken, bouw dan niet alleen een rigide kooi om hem heen. Geef hem goede instructies in natuurlijke taal (skill files), maar zorg er bovenal voor dat hij in de eerste plaats de juiste informatie kan vinden.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →