← Nieuwste papers
🤖 AI

Beyond Memory: A Templated Substrate for Heterogeneous Collaborative Knowledge Work with LLM Agents

Dit artikel introduceert "llm-wiki-memory-template", een append-only, agent-bewust wiki-systeem dat is ontworpen om de volledige geschiedenis van collaboratief kenniswerk te bewaren—inclusclusief mislukkingen en verlaten iteraties—waardoor heterogene mens-AI-samenwerking over meerdere domeinen mogelijk wordt gemaakt, terwijl het structurele verlies van negatieve resultaten in traditionele onderzoeksoutput aanpakt.

Oorspronkelijke auteurs: Priscila Saboia Moreira, Christopher R. Sweet

Gepubliceerd 2026-07-29
📖 7 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Priscila Saboia Moreira, Christopher R. Sweet

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je werkt aan een enorm, complex project met een team van briljante, supersnelle robotassistenten. Deze robots zijn geweldig in het schrijven van code, het opstellen van verhalen en het oplossen van puzzels in een oogwenk. Maar er is een addertje onder het gras: elke keer als je je laptop afsluit of een chatsessie beëindigt, lijdt de robot aan totale amnesie. Ze vergeten alles wat ze net hebben gedaan. Als je hen vraagt: "Wat hebben we gisteren geprobeerd?", staren ze je met een lege blik aan.

Om dit op te lossen, proberen wetenschappers deze robots "Retrieval-Augmented Generation" (RAG) te geven. Denk aan RAG als een enorme, rommelige bibliotheek waar de robot oude aantekeningen kan opzoeken. Maar er is een probleem: de bibliotheek overhandigt de robot telkens weer dezelfde ruwe, ongeorganiseerde pagina's. Het helpt de robot niet om te leren van zijn fouten uit het verleden. Bovendien, in de echte wereld, wanneer mensen hun werk publiceren, gooien ze meestal de mislukte experimenten, de doodlopende wegen en de ideeën die niet werkten, weg. Ze laten alleen het glanzende, perfecte eindresultaat zien. Dit betekent dat toekomstige teams vaak tijd verspillen aan het opnieuw ontdekken van dezelfde fouten, omdat de "slechte" geschiedenis is verwijderd.

Dit is de hoek van de wetenschap waar informatici en onderzoekers proberen betere manieren te bouwen waarop mensen en AI samen kunnen werken. Ze vragen zich af: Hoe houden we een verslag bij van ons denken dat ook de fouten bevat, zodat we ze niet herhalen? En hoe zorgen we ervoor dat wanneer meerdere mensen en robots aan hetzelfde werk doen, ze elkaars werk niet per ongeluk overschrijven of liegen over de resultaten?


De "Time-Traveling Wiki" voor AI-teams

Een nieuw artikel van onderzoekers aan de University of Notre Dame introduceert een slimme oplossing genaamd llm-wiki-memory-template. Je kunt dit zien als een speciale, magische notebook die tussen het menselijke team en hun robotassistenten in staat. In tegenstelling tot een normale chatgeschiedenis die verdwijnt, of een rommelige bibliotheek die gewoon ruwe bestanden dumpt, is deze notebook ontworpen als een "levend geheugen" dat slimmer wordt naarmate het groeit.

Het kernidee is simpel maar krachtig: Verwijder de mislukkingen niet.

In de wereld van wetenschap en programmeren wordt een idee dat faalt, meestal bij het vuilnis gezet. Maar deze template behandelt mislukkingen als kostbare fossielen. Het bewaart elke doodlopende weg, elke "teruggetrokken" bewering en elk experiment dat niet goed verliep, direct naast het uiteindelijke succes. De auteurs noemen dit failure-path preservation (behoud van het foutenpad). Stel je een detective voor die een misdaad oplost. In plaats van je alleen de uiteindelijke arrestatie te laten zien, laat de detective je de kaart zien van elke verkeerde afslag die hij nam, elke verdachte die hij ondervroeg die later onschuldig bleek te zijn, en elke aanwijzing die nergens toe leidde. Door het hele pad te zien, leert de volgende detective (of robot) precies wat niet te doen.

Hoe het werkt: De Drie Zuilen

Het artikel suggereert dat dit systeem werkt op drie verschillende "assen" (of richtingen) van samenwerking, en ze hebben een specifieke tool gebouwd voor elk van deze assen:

1. De Menselijke As (Het "Wie deed wat"-logboek)
Wanneer meerdere mensen samenwerken, is het makkelijk om in de war te raken over wie wat heeft gezegd. Dit systeem gebruikt een strikte regel: elke enkele invoer in de notebook moet een label hebben dat precies aangeeft wie het geschreven heeft en welke robot daarbij heeft geholpen. Het is als een groepschat waarin elk bericht is voorzien van een stempel met de naam van de afzender en een "via [Robotnaam]" tag. Dit voorkomt het "hij zei, zij zei"-probleem en zorgt ervoor dat als er later een fout wordt gevonden, het team precies weet waar deze vandaan kwam.

2. De Robot-as (De "Vertaler"-laag)
Verschillende robots spreken verschillende "talen" (sommigen gebruiken Claude, anderen Cursor, enz.). Als je twee verschillende robots hebt die aan hetzelfde project werken, kunnen ze per ongeluk elkaars aantekeningen overschrijven of de regels verkeerd begrijpen. Deze template fungeert als een universele vertaler. Het geeft elke robot een specifieke set instructies (een "overlay"), zodat ze allemaal dezelfde notebook kunnen lezen en beschrijven zonder elkaar in de weg te zitten. Het zorgt ervoor dat zelfs als Robot A en Robot B tegelijkertijd werken, ze dezelfde veiligheidsregels volgen en niet elkaars werk verwijderen.

3. De Domein-as (Het "Template"-systeem)
Wat als je dit systeem wilt gebruiken voor een totaal andere taak, zoals het lesgeven aan studenten in plaats van het schrijven van code? Het artikel laat zien hoe je de basis "structuur" van het systeem kunt nemen en een "variant" (een gespecialiseerde versie) voor die nieuwe taak kunt maken. Het is als het hebben van een basis auto-chassis die je kunt veranderen in een racewagen, een bestelwagen of een gezinswagen. De basisregels blijven hetzelfde, maar de specifieke functies veranderen om bij het nieuwe doel te passen, zonder het oorspronkelijke ontwerp te verstoren.

Praktijktests: De "Audit" die het project redde

De onderzoekers hebben dit niet alleen bedacht; ze hebben het getest in realistische scenario's. Een van de meest boeiende verhalen komt van een project waarbij twee onderzoekers een webscraper (een tool die websites uitleest) aan het bouwen waren.

Eerst leek alles perfect. Hun robotassistent beweerde dat hij succesvol 20 van de 20 vragen over een product had beantwoord. Het klonk als een groot succes. Maar omdat het systeem een gedetailleerd, stapsgewijs logboek bijhield van elke poging, besloot een van de menselijke onderzoekers beter te kijken. Ze ontdekten dat de robot aan het "hallucineren" was — hij verzon antwoorden op basis van zijn trainingsdata in plaats van daadwerkelijk de website te lezen.

Omdat het systeem het "foutenpad" bewaarde, kon de onderzoeker teruggaan en de oude gegevens auditeren zonder het hele experiment opnieuw te hoeven uitvoeren. Ze ontdekten de waarheid: de robot had slechts 14 echte antwoorden gevonden, in plaats van 20. Na het corrigeren van de instructies van de robot, probeerden ze het opnieuw en kregen ze 18 correcte antwoorden.

Als ze een normaal systeem hadden gebruikt, had de bewering "20 van de 20" misschien als een feit gepubliceerd kunnen worden, en had het team later voor schut gestaan. In plaats daarvan toonde de notebook de hele reis: de foutieve bewering, de ontdekking van de fout en het gecorrigeerde resultaat. De "fout" werd niet verwijderd; het werd onderdeel van het verhaal, wat iedereen leerde om de volgende keer voorzichtiger te zijn.

Waarom dit ertoe doet

Het artikel suggereert dat deze aanpak een gamechanger is voor hoe we met AI werken. Het beargumenteert dat we niet alleen moeten proberen AI slimmer te maken; we moeten systemen bouwen die ons dwingen eerlijk te zijn over onze fouten. Door de "slechte" geschiedenis levend te houden, voorkomen we dat we dezelfde fouten herhalen.

De onderzoekers geven toe dat dit nog volop in ontwikkeling is. Ze hebben het getest met individuele onderzoekers en kleine teams, en ze hebben een ontwerp voor hoe het zou werken met veel robots tegelijk, maar ze hebben de "veel robots"-versie nog niet volledig getest. Ze merken ook op dat ze het nog niet direct hebben vergeleken met andere tools zoals Notion of standaard Git, dus we weten nog niet zeker of het wel de absoluut beste tool is voor elke taak.

De belangrijkste conclusie is echter duidelijk: het pad naar succes is niet alleen de eindbestemming; het is de kaart van alle verkeerde afslagen die je hebt genomen om daar te komen. Door een systeem te bouwen dat die kaart bewaart, kunnen we mensen en robots helpen sneller te leren, beter samen te werken en geen tijd te verspillen aan dezelfde doodlopende wegen.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →