← Nieuwste papers
💬 NLP

Mechanistic Circuit-Based Knowledge Editing in Large Language Models

Dit paper introduceert MCircKE, een nieuw raamwerk dat de 'redeneringskloof' in kennisbewerking van grote taalmodellen overbrugt door causale circuits te identificeren en chirurgisch aan te passen, waardoor geüpdatete feiten succesvol worden gebruikt in meerstapsredeneringen.

Oorspronkelijke auteurs: Tianyi Zhao, Yinhan He, Wendy Zheng, Chen Chen

Gepubliceerd 2026-04-08
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Tianyi Zhao, Yinhan He, Wendy Zheng, Chen Chen

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

De "Redenerings-Gap": Hoe we AI leren om feiten niet alleen te onthouden, maar ook te gebruiken

Stel je voor dat je een enorme, super-intelligente bibliothecaris hebt (een Large Language Model of LLM) die alles weet wat er in de wereld staat. Maar er is een probleem: de wereld verandert snel. Een nieuwe president wordt gekozen, een nieuwe wet wordt aangenomen. Je wilt dat je bibliothecaris deze nieuwe feiten direct weet, zonder dat je de hele bibliotheek moet slopen en opnieuw moet bouwen.

Tot nu toe konden we de bibliothecaris wel een nieuw feit "inplakken" (bijvoorbeeld: "De nieuwe president is X"). Maar als je hem een slimme vraag stelde die twee stappen vereist ("Welke partij leidt deze nieuwe president?"), faalde hij. Hij wist het feit, maar kon het niet gebruiken om de volgende stap te zetten. De auteurs van dit paper noemen dit de "Redenerings-Gap".

Het Probleem: Een losse schakel in de ketting

De onderzoekers (Tianyi Zhao en collega's van de Universiteit van Virginia) ontdekten waarom dit gebeurt. Ze zagen dat bestaande methoden alleen de "opslagplek" van het feit repareerden, maar vergeten waren de "bedrading" die nodig is om dat feit te gebruiken.

  • De oude manier: Het is alsof je een nieuw boek in de bibliotheek zet, maar de kaartjes in het systeem die vertellen waar dat boek staat, niet updatet. Je kunt het boek vinden als je precies weet waar het ligt, maar als je vraagt "Wat heeft dit boek te maken met dat andere boek?", kan de bibliothecaris de link niet leggen.
  • De nieuwe ontdekking: In een AI-model zijn feiten niet alleen opgeslagen in één hoekje. Ze worden verwerkt door een complex netwerk van "draden" (neurale circuits) die informatie van de ene laag naar de andere sturen. Als je alleen de opslag repareert, blijven die draden verbonden met de oude, verouderde logica.

De Oplossing: MCircKE (De Chirurgen van de AI)

De oplossing die ze voorstellen, heet MCircKE. In plaats van de hele AI te herschrijven of willekeurig te oefenen met nieuwe vragen, werkt dit als een chirurgische ingreep.

Hier is hoe het werkt, in drie simpele stappen:

  1. De Kaart Maken (Map):
    De AI krijgt een vraag over een nieuw feit. De onderzoekers kijken dan heel precies naar binnen in de "hersenen" van de AI om te zien welke specifieke draden en schakels (de "circuits") actief zijn bij het beantwoorden van die vraag. Ze maken een kaart van precies welke "wires" het feit opslaan en welke "wires" het doorsturen naar het antwoord.

    • Analogie: Het is alsof je een verkeersagent bent die precies ziet welke wegen gebruikt worden om van punt A naar punt B te komen, inclusief de afritten en kruispunten.
  2. De Aanpassing (Adapt):
    Zodra ze die kaart hebben, maken ze alleen die specifieke draden aan. Ze veranderen de instellingen van alleen die onderdelen die betrokken zijn bij het redeneren.

    • Analogie: In plaats van alle wegen in de stad te herasfalteren (wat duur en chaotisch is), repareren ze alleen de specifieke brug en het kruispunt waar het verkeer vastliep.
  3. Het Resultaat:
    Omdat ze niet alleen de opslagplek hebben veranderd, maar ook de route die het feit moet afleggen, kan de AI het nieuwe feit nu ook gebruiken in complexe, meerstaps vragen.

Waarom is dit zo goed?

De onderzoekers hebben dit getest op een moeilijke test met duizenden vragen. Het resultaat was indrukwekkend:

  • Beter dan de rest: Andere methoden (zoals het simpelweg "leren" van de AI met extra voorbeelden) deden het goed bij simpele vragen, maar faalden bij complexe redeneringen. MCircKE slaagde erin om die kloof te dichten.
  • Geen rommel: Omdat ze alleen de specifieke draden aanpassen, blijft de rest van de kennis van de AI intact. De AI vergeet niet hoe je "2+2" moet doen terwijl je leert wie de nieuwe president is.
  • Geen giswerk: Het is geen "probeer-en-fout" methode. Ze weten precies waar ze moeten grijpen, net als een chirurg die precies weet welke zenuw hij moet prikken.

Conclusie

Kortom: Dit paper lost een groot probleem op in de wereld van AI. Het laat zien dat je een AI niet alleen kunt "leren" door haar meer voorbeelden te geven, maar dat je soms de interne "bedrading" moet begrijpen en aanpassen. Met MCircKE maken ze van een AI die feiten alleen kan opslaan, een AI die feiten ook echt kan gebruiken om slimme conclusies te trekken.

Het is de overstap van een AI die een woordenboek is, naar een AI die een echte denker is.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →