← Nieuwste papers
💬 NLP

Language Models Learn Universal Representations of Numbers and Here's Why You Should Care

Dit onderzoek toont aan dat grote taalmodellen universele, sinusvormige representaties van getallen ontwikkelen die uitwisselbaar zijn tussen verschillende modellen, wat cruciaal is voor het nauwkeurig beoordelen van numerieke vaardigheden en het mechanisch verminderen van rekenfouten.

Oorspronkelijke auteurs: Michal Štefánik, Timothee Mickus, Marek Kadlčík, Bertram Højer, Michal Spiegel, Raúl Vázquez, Aman Sinha, Josef Kuchař, Philipp Mondorf, Pontus Stenetorp

Gepubliceerd 2026-04-23
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Michal Štefánik, Timothee Mickus, Marek Kadlčík, Bertram Højer, Michal Spiegel, Raúl Vázquez, Aman Sinha, Josef Kuchař, Philipp Mondorf, Pontus Stenetorp

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat een groot taalmodel (zoals een slimme chatbot) een enorme bibliotheek is, waar elke letter, elk woord en elk getal een eigen plekje heeft. Voor de meeste woorden is dit plekje een beetje willekeurig, net als hoe je boeken in een kast kunt zetten. Maar voor cijfers (getallen) hebben deze modellen iets heel speciaals ontdekt: ze bouwen een geheim, wiskundig spoor dat lijkt op een golvend patroon.

Deze paper vertelt het verhaal van hoe onderzoekers dit spoor hebben gevonden, waarom het voor bijna alle modellen hetzelfde is, en hoe we dit kunnen gebruiken om de rekenfouten van AI te verbeteren.

Hier is de uitleg in simpele taal, met een paar creatieve vergelijkingen:

1. De "Golf" die iedereen kent

Stel je voor dat je een orkest hebt met verschillende instrumenten (verschillende AI-modellen, zoals Llama, OLMo en Phi). Als ze een willekeurig woord spelen, klinkt het anders per instrument. Maar als ze het woord "vijf" spelen, spelen ze exact hetzelfde liedje.

De onderzoekers hebben ontdekt dat alle AI-modellen getallen niet opslaan als een simpele lijst, maar als een sinusgolf (een golvend lijntje, net als de zee of een geluidsgolf).

  • De ontdekking: Het is alsof alle modellen, ongeacht wie ze gemaakt heeft, een geheim "golf-alfabet" hebben aangenomen. Als je de golf van "3" in model A vergelijkt met de golf van "3" in model B, zien ze er bijna identiek uit. Het is een universele taal die de AI's zelf hebben uitgevonden.

2. Waarom de "oude bril" niet werkt

Voorheen keken onderzoekers naar de binnenkant van deze AI's met een "standaardbril" (een algemeen meetinstrument).

  • De analogie: Stel je voor dat je probeert een radio te luisteren met een bril die alleen geschikt is voor televisie. Je ziet wel beweging, maar je hoort de muziek niet goed.
  • Het probleem: De oude methodes dachten dat AI's getallen slecht onthouden of dat ze verwarrend waren. Maar toen de onderzoekers een nieuwe, speciale bril (een "sinus-probe") opzetten die specifiek is afgestemd op die golfpatronen, zagen ze iets verbazingwekkends: de AI's onthouden getallen tot wel 99% nauwkeurig, zelfs als het om hele lange getallen gaat. De oude methode had gewoon de verkeerde manier om te kijken.

3. De "Reis" door het brein

Een AI-model heeft veel lagen, net als een gebouw met veel verdiepingen.

  • De analogie: Stel je voor dat een getal een pakketje is dat door een fabriek gaat. Bij elke verdieping (laag) wordt het pakketje even aangepakt.
  • De bevinding: Het mooie is dat het pakketje (het getal) zijn vorm behoudt. Of het nu in de eerste verdieping is of in de laatste, het blijft een duidelijke golf. Je kunt dus een "detective" (een meetinstrument) trainen op de eerste verdieping en diezelfde detective gebruiken op de tiende verdieping om te zien wat er gebeurt. Het getal verliest zijn identiteit niet onderweg.

4. Het "Reparatie"-experiment (Waarom dit belangrijk is)

Dit is het meest spannende deel. De onderzoekers ontdekten dat wanneer een AI een fout maakt bij het rekenen (bijvoorbeeld: 2 x 3 = 7), het golfpatroon van het antwoord een beetje "vervormd" is.

  • De analogie: Stel je voor dat de AI een muzikant is die een noot verkeerd speelt. De onderzoekers hebben een manier gevonden om die noot fysiek te "sturen" terug naar de juiste toonhoogte.
  • Het resultaat: Door de interne golf van de AI een klein beetje te corrigeren (te "sturen" naar het perfecte golfpatroon), konden ze tot 40% van de rekenfouten oplossen. Het is alsof je een scheef hangend schilderij rechtzet en plotseling ziet je het hele schilderij weer scherp.

5. Niet alleen voor cijfers, maar ook voor tijd

De onderzoekers hebben ook gekeken naar andere dingen die een volgorde hebben, zoals de dagen van de week of de maanden.

  • De vergelijking: Net als bij cijfers, slaan AI's ook deze dingen op in een cirkelvormig golfpatroon. Het is alsof de dagen van de week op een wiel zitten. De nieuwe meetmethode werkt ook hier perfect, zelfs als er heel weinig voorbeelden zijn (bijvoorbeeld: er zijn maar 7 dagen in een week).

Waarom moet je hier om geven?

  1. Betrouwbare AI: We weten nu dat AI's getallen eigenlijk heel goed begrijpen, maar dat we de verkeerde tools gebruikten om dit te zien.
  2. Fouten oplossen: We kunnen nu AI's helpen om minder fouten te maken in rekenopdrachten door hun interne "golf" recht te zetten.
  3. Beter inzicht: Het leert ons dat we niet voor alles dezelfde meetinstrumenten moeten gebruiken. Voor getallen hebben we een speciale "golf-detector" nodig, net zoals je voor water een andere bril nodig hebt dan voor lucht.

Kortom: AI's hebben een geheime, universele manier gevonden om getallen op te slaan als een golf. Als we leren om naar die golf te kijken in plaats van naar een willekeurige lijst, kunnen we AI's veel slimmer en accurater maken.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →