← Nieuwste papers
🤖 AI

Memory in the Loop: In-Process Retrieval as ExtendedWorking Memory for Language Agents

Dit artikel betoogt dat het verplaatsen van geheugenretrieve van een trage, externe netwerkopslag naar een snelle, in-process opslag het transformeert tot effectief uitgebreid werkgeheugen voor taalagenten, waardoor de door latentie veroorzaakte prestatieverslechtering die agenten momenteel dwingt om retrieve te beperken tot één keer per beurt, wordt geëlimineerd.

Oorspronkelijke auteurs: Yusuf Khan, Carlo Lipizzi

Gepubliceerd 2026-07-08
📖 6 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Yusuf Khan, Carlo Lipizzi

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Het Kernprobleem: De "Trage Bibliothecaris" vs. Het "Notitieboekje"

Stel je voor dat je een complexe puzzel probeert op te lossen. Je hebt een briljante assistent (de AI-agent) die erg slim is, maar een heel kort concentratievermogen heeft. Om hen te helpen, geef je ze een notitieboekje (het "context window") waarin ze belangrijke feiten kunnen opschrijven.

De Oude Manier (Huidige AI):
Momenteel, als de assistent iets vergeet of een feit moet controleren dat niet in hun directe notitieboekje staat, moeten ze stoppen, naar een enorme bibliotheek verderop in de straat lopen (een clouddatabase), een bibliothecaris vragen om het boek, wachten tot de bibliothecaris het heeft gevonden, en weer teruglopen.

  • Het Probleem: Deze reis duurt lang (ongeveer 100 milliseconden). Als de assistent bij elke nieuwe stap die ze bedenken even naar de bibliotheek moet lopen, komt het hele proces tot stilstand. Omdat de reis zo traag is, zeggen ingenieurs tegen de assistent: "Ga slechts één keer aan het begin van de taak naar de bibliotheek, en raad de rest maar." Dit leidt tot fouten omdat de assistent dingen vergeet die tijdens de taak zijn gebeurd.

Het Nieuwe Idee (Memory in the Loop):
De auteurs van dit paper vroegen zich af: "Wat als de bibliotheek niet verderop in de straat stond, maar direct op het bureau van de assistent?"
Ze bouwden een klein, supersnel geheugensysteem dat binnenin het brein van de assistent leeft (in-process). Het controleren van dit geheugen duurt slechts 0,0001 seconden (100 microseconden).

  • Het Resultaat: De assistent kan nu bij elke stap hun geheugen controleren, zonder dat het proces vertraagt. Het is also wordt een notitieboekje dat zichzelf direct bijwerkt, in plaats van dat je naar een bibliotheek moet lopen.

De Grote Ontdekking: Snelheid Verandert Hoe We Denken

Het paper betoogt dat snelheid niet alleen over het besparen van tijd gaat; het verandert de aard van het geheugen.

  • De Analogie van het "Gereedschap" vs. Het "Brein":
    • Als je 10 minuten moet lopen om een gereedschap te pakken, is dat gereedschap een extern object. Je moet van tevoren plannen om het te gebruiken, en je kunt vergeten het mee te nemen.
    • Als het gereedschap in je zak zit en je het direct kunt pakken, wordt het onderdeel van jouw lichaam. Je gebruikt het automatisch zonder erbij na te denken.
    • Het paper beweert dat omdat dit nieuwe geheugen zo snel is, het niet langer een "database waar de AI advies bij vraagt" is, maar "werkgeheugen dat de AI heeft". Het stelt de AI in staat om continu te redeneren zonder de flow te onderbreken.

De Experimenten: Bewijzen Dat het Werkt

De onderzoekers testten dit met twee hoofdscenario's:

1. De "Reisplanner"-test (Kan het feiten onthouden?)

  • De Opzet: De AI moest een reis plannen op basis van 5 specifieke regels (bijv. "Geen honden", "Moet goedkoop zijn"). Het gesprek was lang, waardoor de regels uiteindelijk uit het kortetermijnnotitieboekje (het context window) van de AI zouden "vallen".
  • Het Resultaat:
    • Zonder het snelle geheugen vergat de AI de regels volledig (0 van de 5 correct).
    • Met het snelle geheugen onthield de AI de meeste regels (3,6 tot 4,8 van de 5 correct).
    • Noot: De onderzoekers ontdekten ook dat als je de AI simpelweg zou vragen om "de regels in elke zin te herhalen", dit perfect zou werken. Maar dit is duur (alsof je een heel boek telkens opnieuw schrijft wanneer je een pagina toevoegt). Het snelle geheugen bereikte vergelijkbare resultaten zonder die zware kosten.

2. De "Loop Guard"-test (Kan het stoppen met het herhalen van fouten?)

  • De Opzet: De AI moest een lijst met beveiligingsmeldingen controleren. Sommige meldingen waren duplicaten van meldingen die hij al eerder had gezien. Het doel was om de AI te stoen om niet twee keer hetzelfde onderzoek te doen.
  • De Test: Ze vertraagden de geheugensnelheid kunstmatig om te zien wat er gebeurde.
    • Snel Geheugen (0,0001s): De AI controleerde elke melding tegen zijn geheugen. Hij maakte nul fouten.
    • Traag Geheugen (0,1s): De AI kon het zich niet veroorloven om elke melding te controleren omdat dit te lang zou duren. Hij sloeg controles over en herhaalde acties 7 van de 12 keer.
    • De Les: De AI werd niet "dommer". Hij kon het simpelweg niet veroorloven om zijn geheugen snel genoeg te controleren. Wanneer het geheugen instant was, stopte de AI met het maken van redundante fouten.

De Verborgen Bottleneck: De "Vertaler"

De onderzoekers ontdekten één addertje onder het gras. Hoewel het geheugen zelf instant was, moest de AI nog steeds "vertalen" wat hij dacht naar een formaat dat het geheugen kon begrijpen (dit heet "embedding").

  • Als deze vertaling via het internet verliep, was het traag.
  • De Oplossing: Door een kleine, lokale vertaler te gebruiken (een klein AI-model dat op dezelfde computer draait), maakten ze het gehele proces (denken + vertalen + geheugen controleren) slechts 0,00004 seconden snel. Dit is snel genoeg om op elke stap van de redenering van de AI te gebeuren.

Samenvatting van de Claims

  1. Snelheid is de Poortwachter: De reden dat AI-agents hun geheugen niet constant controleren, is niet omdat het een slecht idee is; het is omdat huidige clouddatabases te traag zijn.
  2. In-Process is de Oplossing: Door het geheugen naar dezelfde computer als de AI te verplaatsen (in-process), neemt de snelheid met 1.000 keer toe.
  3. Het Verandert Gedrag: Wanneer het geheugen instant is, stopt de AI met het maken van "redundante" fouten (het twee keer doen van hetzelfde) omdat hij zijn geschiedenis op elke stap kan controleren.
  4. Het Is Geen Magie: De AI werd niet slimmer; het systeem rondom de AI werd slimmer. De AI maakt nog steeds fouten als de geheugencontrole te traag is, maar met het snelle geheugen voorkomt het systeem deze fouten automatisch.

Kortom: Dit paper bewijst dat als je een AI een "supersnel notitieboekje" geeft dat in zijn eigen brein leeft, de AI kan stoppen met dingen vergeten en stoppen met het herhalen van fouten, waardoor externe opslag effectief verandert in een echt onderdeel van zijn denkproces.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →