← Nieuwste papers
🤖 machine learning

Lifelong In-Context Learning with Transformers Requires Parametric Forms of Attention

Dit artikel betoogt dat het uitbreiden van in-context leren naar lifelong-omgevingen vereist dat de geheugenintensieve, niet-parametrische softmax-attention van standaard transformers wordt vervangen door parametrische attention-mechanismen die key-value-relaties leren via online regressie om een constant geheugenspeld te behouden, terwijl het tegelijkertijd de huidige beperkingen identificeert en openstaande vragen voorstelt om de ontwikkeling van long-horizon AI-agenten te begeleiden.

Oorspronkelijke auteurs: Luke McDermott, Robert W. Heath jr., Rahul Parhi

Gepubliceerd 2026-06-25
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Luke McDermott, Robert W. Heath jr., Rahul Parhi

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Het Grote Probleem: De "Oneindige Notebook" Valstrik

Stel je voor dat je een robot probeert te leren een levenslange assistent te zijn. Je wilt dat de robot leert van alles wat hij ziet, hoort en doet, vanaf het moment dat hij wordt aangezet tot de dag dat hij wordt uitgeschakeld.

Huidige AI-modellen (Transformers) zijn als briljante studenten die kunnen leren van een kort verhaal dat je ze nú voorleest. Dit wordt In-Context Learning genoemd. Als je zegt: "Hier is een regel: als je een rood licht ziet, stop dan," volgt de robot die direct.

Er is echter een addertje onder het gras. Om deze regels te onthouden, gebruiken huidige modellen een methode die lijkt op het bijhouden van een groeiende notebook. Elke keer dat de robot een nieuw feit leert of een nieuw voorbeeld ziet, schrijft hij dat op een nieuwe pagina in de notebook.

  • Het Probleem: Naarmate de robot langer leeft, wordt de notebook dikker. Uiteindelijk wordt de notebook zo zwaar (te veel geheugen) en duurt het zo lang om erdoorheen te lezen (te veel rekenkracht) dat de robot niet meer kan functioneren. Hij loopt tegen een "hardwaremuur" aan. Hij kan geen notebook met een miljoen pagina's in zijn zak dragen.

De Voorgestelde Oplossing: De "Slimme Samenvatter"

De auteurs stellen dat om AI echt levenslang te maken, we moeten stoppen met het gebruik van de "groeiende notebook" en moeten beginnen met een Slimme Samenvatter.

In plaats van elk enkel rauw feit op te schrijven (zoals "Om 14:00 uur zag ik een blauwe auto"), moet de robot leren om die informatie te comprimeren naar een mentaal model van een vaste grootte.

  • De Analogie: Stel je voor dat je een taal leert.
    • Huidige Methode (Niet-parametrisch): Je houdt een woordenboek bij dat groter wordt elke keer dat je een nieuw woord leert. Uiteindelijk kun je het woordenboek niet meer dragen.
    • Nieuwe Methode (Parametrisch): Je onthoudt niet elk woord afzonderlijk. In plaats daarvan leer je de grammatica en de patronen van de taal. Je brein (het model) blijft dezelfde grootte, maar wordt slimmer in het voorspellen van wat er nu komt op basis van de geleerde regels.

Hoe het werkt: "Test-Time Training"

Het artikel suggereert een specifieke manier om deze Slimme Samenvatter te bouwen. Ze noemen dit Test-Time Training.

Beschouw het aandachtsmechanisme van de robot (het deel dat beslist waar de focus op moet liggen) niet als een statisch zoekinstrument, maar als een student die een toets maakt terwijl de leraar nog aan het praten is.

  1. De Opzet: De robot ontvangt een stroom informatie (keys en values).
  2. De Taak: Het probeert de verbinding tussen deze informatie te raden.
  3. De Update: Direct nadat het een gok heeft gedaan, controleert het of het goed zat. Als het fout zat, past het onmiddellijk zijn interne "breingewichten" aan om beter te worden.
  4. Het Resultaat: In plaats van het verleden op te slaan om het toekomstige te onthouden, werkt het de huidige kennis bij om de toekomst te voorspellen.

Dit stelt de robot in staat om een oneindige stroom informatie te verwerken zonder ooit tekort te komen aan geheugen, omdat het de stroom niet opslaat, maar er van leert.

Waarom huidige "Shortcuts" niet werken

Het artikel wijst erop dat mensen hebben geprobeerd het "groeiende notebook"-probleem op te lossen met behulp van Sparse Attention.

  • De Analogie: Dit is also weakly de robot besluit: "Ik kan mijn hele notebook niet lezen, dus ik gooi gewoon de pagina's weg die ik saai vind en houd de laatste 10 pagina's over."
  • De Fout: Dit werkt voor korte taken, maar voor een levenslange agent faalt het. Als de robot drie weken geleden een pagina weggooide waarop stond "Het wachtwoord is 1234", kan hij vandaag nooit meer een puzzel oplossen. Hij moet oude herinneringen samenvoegen in algemene kennis, in plaats van ze alleen maar te verwijderen.

De Blokkades (Openstaande Vragen)

De auteurs geven toe dat hoewel dit idee van een "Slimme Samenvatter" de juiste weg is, we het perfecte recept nog niet hebben. Ze stellen drie belangrijke vragen voor de toekomst:

  1. Wat is het doel? Moet de robot gewoon exacte feiten proberen te onthouden (zoals een fotoalbum), of moet hij proberen het concept achter de feiten te begrijpen (zoals een filosoof)? Het artikel suggereert dat we de robot moeten leren te generaliseren, niet alleen te memoriseren.
  2. Hoe leren we trends? Als de robot vandaag iets leert, hoe zorgt hij er dan voor dat die kennis morgen niet wordt overschreven? We hebben betere manieren nodig om de hersenen te updaten zodat het langetermijnpatronen onthoudt, en niet alleen de laatste paar seconden.
  3. Waar moet het van leren? Op dit moment leert de robot van eenvoudige, lineaire verbindingen. Misschien moeten we het leren om naar complexere, niet-lineaire patronen in de data te kijken om de wereld echt te begrijpen.

Samenvatting

Het artikel betoogt dat voor AI om een echte levenslange metgezel te worden, het moet stoppen met proberen alles te onthouden in een gigantisch, groeiend bestand. In plaats daarvan moet het leren om continu een brein van vaste grootte bij te werken dat ervaringen samenvat. Dit vereist een verandering in hoe de AI "aandacht besteedt", door het te veranderen van een statische bibliothecaris in een dynamische, lerende student die slimmer wordt met elk moment, zonder ooit meer ruimte nodig te hebben.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →