CoRect: Context-Aware Logit Contrast for Hidden State Rectification to Resolve Knowledge Conflicts
CoRect is een nieuwe methode die hallucinaties in Retrieval-Augmented Generation (RAG) vermindert door de verborgen toestanden van een model te corrigeren in lagen waar interne voorkennis de opgehaalde informatie probeert te overschrijven.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Stel je voor dat je een superintelligente assistent hebt die bijna alles weet uit zijn eigen geheugen. Maar er is een probleem: soms geef je die assistent een actueel krantenartikel om te lezen, en terwijl hij het leest, zegt hij ineens: "Nee, ik weet het beter, uit mijn eigen geheugen weet ik dat het anders zit!"
Dit noemen wetenschappers een "knowledge conflict" (kennisconflict). De assistent negeert de nieuwe informatie die je hem net hebt gegeven, omdat zijn eigen, oude geheugen te luidruchtig is.
Dit paper, genaamd CoRect, heeft een slimme manier gevonden om dit op te lossen. Hier is de uitleg in gewone mensentaal.
Het probleem: De "Interne Stem" die te hard schreeuwt
Stel je voor dat je een examen maakt. Je hebt een tekstboek voor je liggen met het juiste antwoord, maar in je hoofd zit een irritante stem die constant roept: "Nee, het is optie A!" (terwijl het in het boek optie B is).
De onderzoekers ontdekten dat dit bij AI-modellen (zoals ChatGPT) echt gebeurt in de "diepere lagen" van hun brein. Het werkt zo:
- In de eerste lagen van het AI-brein begrijpt de computer de tekst die je geeft nog prima.
- Maar naarmate de informatie door de lagen stroomt, komen er bepaalde "geheugen-cellen" (de FFN-lagen) tegen die als een soort hardnekkige vooroordelen werken.
- Deze cellen "overschrijven" de nieuwe informatie met het oude, foutieve geheugen. De nieuwe informatie wordt letterlijk weggeperst.
De oplossing: CoRect (De "Fluister-correctie")
De onderzoekers wilden niet de hele assistent herschrijven (dat is te duur en moeilijk), en ze wilden ook niet simpelweg het antwoord op het laatste moment forceren (dat maakt de assistent vaak een beetje dom of onlogisch praten).
In plaats daarvan bedachten ze CoRect. Je kunt dit vergelijken met een geluidsdemper voor de verkeerde stem.
Het proces werkt in twee stappen:
Stap 1: De juiste stem herkennen (De Luisteraar)
Voordat de AI gaat praten, kijkt CoRect heel even naar de tekst die je hebt gegeven. Het zoekt naar woorden die echt in de tekst staan en die belangrijk lijken. Het is alsof de assistent even een pen gebruikt om het juiste antwoord in de tekst te onderstrepen voordat hij begint te antwoorden.
Stap 2: De ruis wegfilteren (De Geluidsdemper)
Nu komt de magie. In plaats van de assistent te dwingen om het juiste antwoord te zeggen, gaat CoRect in het "brein" van de AI kijken. Het zoekt precies die lagen op waar de "irritante stem" (het oude geheugen) het hardst begint te schreeuwen.
CoRect doet dan iets heel subtiels: het brengt een soort tegen-geluid aan dat precies de negatieve energie van de oude stem neutraliseert. Het is niet zo dat we de assistent iets nieuws leren; we zorgen er alleen voor dat de verkeerde stem even stil is, zodat de assistent de informatie uit de tekst weer kan horen.
Waarom is dit zo bijzonder? (De Metafoor)
De meeste andere methoden zijn als een stok achter de deur: ze duwen de AI aan het einde van de rit met een harde klap richting het juiste antwoord. Dat werkt wel, maar de AI raakt daardoor vaak de draad van het verhaal kwijt of gaat vreemde zinnen maken.
CoRect is meer als een dirigent: hij grijpt niet in door de muzikanten te dwingen een verkeerde noot te spelen, maar hij vraagt de trompetten die te hard spelen simpelweg om even zachter te gaan, zodat de viool (de nieuwe informatie) weer hoorbaar wordt.
De resultaten
De onderzoekers hebben dit getest op verschillende taken (zoals vragen beantwoorden en teksten samenvatten) en de resultaten waren fantastisch:
- De AI wordt veel betrouwbaarder.
- De AI stopt met "hallucineren" (dingen verzinnen die niet in de tekst staan).
- De AI blijft nog steeds vloeiend en natuurlijk praten, omdat we het brein niet dwingen, maar alleen helpen om de juiste informatie te horen.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.