← Nieuwste papers
🤖 AI

Open, Reliable, and Collective: A Community-Driven Framework for Tool-Using AI Agents

Dit paper introduceert OpenTools, een gemeenschapsgedreven framework dat de betrouwbaarheid van tool-gebruikende AI-agenten verbetert door niet alleen de agenten, maar ook de onderliggende tools te standaardiseren en te evalueren, wat leidt tot significante prestatiewinsten.

Oorspronkelijke auteurs: Hy Dang, Quang Dao, Meng Jiang

Gepubliceerd 2026-04-02
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Hy Dang, Quang Dao, Meng Jiang

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat een Grote Taalmodel (LLM) een slimme, maar soms wat ongeduldige assistent is. Deze assistent kan geweldige verhalen schrijven, vragen beantwoorden en zelfs redeneren. Maar er is een probleem: deze assistent is soms te zelfverzekerd. Hij "hallucineert" feiten, maakt rekenfouten of weet niet hoe hij een calculator moet gebruiken.

Om dit op te lossen, geven we de assistent een gereedschapskist met externe tools (zoals een zoekmachine, een rekenmachine of een medische database). Maar hier komt de twist: in de huidige wereld van AI is deze gereedschapskist vaak rommelig, onbetrouwbaar en vol met defecte hamers.

Dit paper introduceert OPENTOOLS, een nieuw, open en gemeenschapsgedreven project om die gereedschapskist te repareren en te verbeteren.

Hier is de uitleg, vertaald naar alledaags taalgebruik met een paar creatieve vergelijkingen:

1. Het Probleem: De "Slechte Gereedschapskist"

Vroeger dachten onderzoekers dat de enige fout die gemaakt werd, zat in hoe de assistent de gereedschappen gebruikte (bijvoorbeeld: "Hij heeft de verkeerde knop ingedrukt").

OPENTOOLS zegt echter: "Wacht even, misschien is de hamer zelf wel verbogen!"
Er zijn twee soorten fouten:

  1. Fout in gebruik: De assistent pakt de verkeerde tool.
  2. Fout in de tool zelf: De tool werkt niet goed, is verouderd, of geeft een fout antwoord (bijvoorbeeld omdat een website is veranderd).

Huidige systemen focussen alleen op de eerste fout, maar vergeten dat de gereedschappen zelf vaak kapot zijn. Het is alsof je een racewagen bouwt, maar de banden zijn van karton. Het maakt niet uit hoe goed de chauffeur rijdt; de auto valt uit elkaar.

2. De Oplossing: OPENTOOLS als een "Open Werkplaats"

OPENTOOLS is niet zomaar een lijstje met tools. Het is een gemeenschappelijke werkplaats waar iedereen kan helpen.

  • Standaardisatie (De Universele Sleutel):
    In de huidige wereld heeft elke tool een eigen sleutelgat. Je hebt een sleutel voor de zoekmachine, een andere voor de calculator, en weer een andere voor de code-vertaler. Dat is frustrerend.
    OPENTOOLS maakt een universele sleutel (een standaard formaat). Of je nu een ReAct-agent of een Multi-Agent gebruikt, ze passen allemaal in hetzelfde slot. Het is alsof je van een verzameling verschillende sleutels overstapt op één universele sleutel die bij elke deur past.

  • De Test-Workshop (De Kwaliteitscontrole):
    Iedereen kan nieuwe tools toevoegen, maar voordat ze de kast in mogen, moeten ze door een testproces.

    • Vergelijking: Stel je voor dat je een nieuwe koekjesmachine in de winkel zet. Bij OPENTOOLS moet die machine eerst 100 keer koekjes bakken. Als er één keer een gebroken koekje uitkomt, wordt de machine teruggestuurd naar de werkbank.
    • Dit proces is continu. Als de maker van een tool (bijvoorbeeld Google) hun website verandert, merken de tests dit direct. De "betrouwbaarheidsscore" van die tool wordt dan verlaagd, zodat de AI weet: "Oeps, die tool is vandaag onbetrouwbaar, gebruik hem niet."
  • De Open Werkbank (De Gemeenschap):
    Niemand hoeft alles alleen te doen. Als jij ziet dat een tool faalt, kun jij een nieuwe test toevoegen. Als jij een slimme nieuwe tool hebt bedacht, kun jij die delen. Het is een levend ecosysteem, net als Wikipedia, maar dan voor AI-gereedschappen.

3. Wat leverde dit op? (De Resultaten)

De onderzoekers hebben hun nieuwe gereedschapskist (OPENTOOLS) getest tegen een bestaande, bekende kist (OctoTools).

  • Het resultaat: AI-agenten met de nieuwe, betere gereedschapskist presteerden 6% tot 22% beter.
  • De les: Zelfs als je een heel slimme AI hebt (een "grote brein"), helpt het niet als je hem een slechte rekenmachine geeft. Als je de kwaliteit van de gereedschappen verbetert, wordt de hele AI beter.
  • Specifiek voor moeilijke taken: Bij simpele vragen doet de AI het al goed. Maar bij complexe taken (zoals "Los dit wiskundige raadsel op en zoek de juiste medicatie op") maakt de kwaliteit van de tools het verschil tussen succes en mislukking.

Samenvatting in één zin

OPENTOOLS is een gemeenschapsproject dat ervoor zorgt dat AI-agenten niet alleen leren hoe ze gereedschappen moeten gebruiken, maar ook dat ze werken met gereedschappen die echt werken, door ze continu te testen, te verbeteren en openbaar te maken voor iedereen.

Het is de overstap van "een AI met een doos vol kapotte hamers" naar "een AI met een professionele, goed onderhouden gereedschapskist waar iedereen aan mee kan bouwen."

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →