← Nieuwste papers
💬 NLP

Agentic Context Engineering: Evolving Contexts for Self-Improving Language Models

Dit paper introduceert ACE (Agentic Context Engineering), een kader dat contexten behandelt als evoluerende speelboeken die via een modulaire cyclus van generatie, reflectie en curatie kennis behouden en verfijnen, waardoor taakspecifieke prestaties aanzienlijk worden verbeterd zonder labelsupervisie of gewichtsupdates.

Oorspronkelijke auteurs: Qizheng Zhang, Changran Hu, Shubhangi Upasani, Boyuan Ma, Fenglu Hong, Vamsidhar Kamanuru, Jay Rainton, Chen Wu, Mengmeng Ji, Hanchen Li, Urmish Thakker, James Zou, Kunle Olukotun

Gepubliceerd 2026-03-31
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Qizheng Zhang, Changran Hu, Shubhangi Upasani, Boyuan Ma, Fenglu Hong, Vamsidhar Kamanuru, Jay Rainton, Chen Wu, Mengmeng Ji, Hanchen Li, Urmish Thakker, James Zou, Kunle Olukotun

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Titel: ACE: De Slimme Assistent die Leren Loopt in plaats van Herhalen

Stel je voor dat je een zeer intelligente, maar soms wat vergeetachtige robot hebt. Deze robot is getraind op een enorme hoeveelheid boeken en internet, maar als je hem een complexe taak geeft (zoals het regelen van je financiële administratie of het oplossen van een puzzel in een computerprogramma), maakt hij soms fouten.

De oude manier om deze robot slimmer te maken was als het herschrijven van zijn gehele brein (de "gewichten" van het model). Dat is duur, langzaam en moeilijk.

Deze paper introduceert ACE (Agentic Context Engineering). In plaats van het brein te herschrijven, geven we de robot een dynamisch, groeiend handboek dat hij bij elke fout bijleert.

Hier is hoe het werkt, vertaald naar alledaagse analogieën:

1. Het Probleem: De "Korte Samenvatting" Valstrik

Vroeger probeerden ontwikkelaars de instructies voor de robot steeds korter en bondiger te maken. Ze dachten: "Hoe minder tekst, hoe beter."

  • De analogie: Stel je voor dat je een kok een recept geeft, maar je knipt er alle details uit omdat je het kort wilt houden. Je zegt alleen: "Kook de pasta." De kok vraagt zich af: "Hoeveel water? Hoeveel zout? Hoe lang?"
  • Het gevolg: De robot verloor belangrijke details (zoals specifieke regels voor bankzaken of fouten die hij eerder maakte). Dit noemen de auteurs "Context Collapse" (informatie-inzakking). De robot werd steeds slimmer in het samenvatten, maar steeds dommer in het uitvoeren van complexe taken.

2. De Oplossing: ACE als een "Levendig Spelboek"

ACE behandelt de instructies niet als een statisch document, maar als een groeiend spelpakket (playbook) dat zich voortdurend ontwikkelt. Het werkt in drie stappen, alsof je een team hebt:

A. De Generator (De Speler)

Dit is de robot die de taak uitvoert. Hij probeert het probleem op te lossen.

  • Analogie: Een voetballer die een penalty neemt. Soms scoort hij, soms mist hij.

B. De Reflector (De Coach)

Dit is een tweede robot die kijkt naar wat de speler deed. Hij analyseert de fouten en successen.

  • Analogie: De coach die zegt: "Je mistte omdat je te vroeg naar links keek. Volgende keer, kijk eerst naar de keeper."
  • Belangrijk: De coach maakt geen lange, saaie samenvattingen. Hij pakt specifieke, bruikbare tips eruit.

C. De Curator (De Archivaris)

Dit is de robot die de tips van de coach opslaat in het handboek.

  • Analogie: De teammanager die een nieuwe pagina toevoegt aan het trainingsboek: "Tip #42: Kijk eerst naar de keeper bij penalty's."
  • Het slimme trucje: In plaats van het hele boek opnieuw te schrijven (wat fouten kan maken), plakt de Curator alleen de nieuwe tip erbij. Dit heet een "Delta Update" (een klein stukje toevoegen).

3. Waarom is dit zo goed?

  • Geen Vergeten: Omdat het handboek groeit in plaats van herschreven wordt, verdwijnen de oude, waardevolle tips nooit. De robot onthoudt dat hij gisteren een fout maakte met een specifieke bank-app, en dat staat nu voor altijd in het boek.
  • Zelflerend zonder Leraar: ACE kan leren zonder dat iemand de juiste antwoorden hoeft in te voeren. Als de robot een fout maakt in een computerprogramma, ziet hij direct: "Oh, de code liep vast." De coach (Reflector) zegt dan: "Gebruik die andere functie." De robot leert van zijn eigen ervaring.
  • Schaalbaar: Het is goedkoper en sneller dan het hele brein van de robot herschrijven. Je bouwt gewoon een steeds dikker, maar beter gestructureerd handboek op.

4. De Resultaten in het Dagelijkse Leven

De auteurs hebben ACE getest op twee gebieden:

  1. Agenten (Robots die taken uitvoeren): Op een leaderboard voor complexe taken (AppWorld) deed ACE het beter dan de beste commerciële robots, zelfs al gebruikten ze een kleinere, goedkopere robot.
  2. Financiële Analyse: Bij het analyseren van ingewikkelde financiële documenten (zoals belastingaangiftes) was ACE veel accurater dan andere methoden.

Kortom:
ACE is als het geven van een levendige, groeiende notitieblok aan een slimme assistent. In plaats van te zeggen: "Wees kort en bondig," zeggen ze: "Schrijf alles op wat je leert, maak er een handig naslagwerk van, en gebruik dat om de volgende keer slimmer te zijn." Hierdoor worden AI-systemen betrouwbaarder, slimmer en goedkoper, zonder dat we ze hoeven te "herschrijven".

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →