← Nieuwste papers
🤖 machine learning

Learning in Infinitesimal Non-Compositional Sketches

Dit artikel introduceert LINCS, een categorisch raamwerk dat machine learning herdefinieert als de zoektocht naar een coalgebraisch vast punt binnen een toren van tangent-gelifte sketches, waarmee niet-compositionaliteit wordt geadresseerd als een falen van universele factorisatie in plaats van een rekenkundige fout.

Oorspronkelijke auteurs: Sridhar Mahadevan

Gepubliceerd 2026-07-17
📖 10 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Sridhar Mahadevan

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

De Verborgen Grammatica van Lerende Machines

Stel je voor dat je een robot probeert te leren een videogame te spelen. In de wereld van machine learning is de standaardmanier om dit te doen door de robot een scorekaart te geven. Als de robot een fout maakt, gaat de score omlaag; als het goed gaat, gaat de score omhoog. De robot past vervolgens zijn interne instellingen aan om de volgende keer een betere score te halen. Dit wordt "optimalisatie" genoemd, en het werkt ongelooflijk goed voor alles van het herkennen van katten op foto's tot het vertalen van talen. Maar er is een addertje onder het gras: deze methode behandelt het brein van de robot als een zwarte doos. Het geeft alleen om het eindcijfer, en negeert hoe de robot daar kwam of of de gebruikte logica eigenlijk wel zinvol is.

Stel je nu voor dat je, in plaats van alleen naar de eindscore te kijken, in het brein van de robot kunt gluren om te zien of zijn gedachten correct aan elkaar "vastzitten". In de wiskunde en informatica wordt dit idee van dingen die perfect in elkaar passen "compositionaliteit" genoemd. Het is alsoals controleren of de tandwielen in een klok soepel in elkaar grijpen of of de zinnen in een verhaal logisch op elkaar volgen. Soms leert een robot vals te spelen: hij kan het juiste antwoord krijgen om de verkeerde reden, of zijn interne logica kan uit elkaar vallen als je er van dichtbij naar kijkt. Dit artikel, getiteld "Learning in Infinitesimal Non-Compositional Sketches" (of afgekort LINCS), komt uit het veld van de categorische machine learning. Dit is een chique manier om de regels van de abstracte wiskunde (specifiek de categorietheorie) te gebruiken om te beschrijven hoe machines leren. Het artikel stelt een diepe vraag: Wat gebeurt er wanneer we niet alleen naar de fouten van de robot kijken, maar ook naar hoe die fouten veranderen wanneer we het brein van de robot een heel klein, heel klein beetje een duwtje geven?

Het Grote Idee van het Papier: De "Kleine Nudge"-test

Dit artikel stelt een nieuwe manier voor om naar machine learning te kijken, genaamd LINCS. In plaats van alleen te vragen: "Heeft de robot het antwoord goed?" (wat meestal een simpel ja of nee is, of een getal), vraagt LINCS: "Is de logica van de robot kapot, en als we het brein ervan lichtjes laten trillen, wordt de breuk dan erger, blijft deze gelijk, of herstelt deze zichzelf?"

De auteurs suggereren dat elke keer dat een machine learning-model faalt, het niet alleen een wiskundige fout is; het is een falen van compositie. Stel je voor dat je een toren bouwt van blokken. Als de toren omvalt, zou een normale leraar misschien gewoon zeggen: "Je hebt punten verloren." Een LINCS-leraar zou echter naar de toren kijken en zeggen: "De blokken pasten niet goed in elkaar omdat het onderste blokje gekanteld was." Maar LINCS gaat nog een stap verder. Het vraagt: "Als we dat onderste blokje met een microscopisch kleine beweging een duwtje geven, wankelt de hele toren dan op een manier die een verborgen gebrek onthult?"

In de taal van het artikel wordt dit "microscopische duwtje" een infinitesimaal genoemd. De auteurs behandelen het leerproces als een kaart. Als de kaart perfect is, leiden alle paden naar de juiste bestemming. Als de kaart kapot is, sluiten de paden niet op elkaar aan. LINCS neemt deze kapotte kaart en maakt er een "tangente" versie van—een kaart van de kaart. Het controleert of de kleine fouten in de oorspronkelijke kaart ook niet meer op elkaar aansluiten in de nieuwe, ingezoomde versie. Als dat het geval is, heeft het model een diep structureel probleem dat een simpele scorekaart zou missen.

De "Tangent Lift": Het Onzichtbare Zien

De kern van het artikel is een concept genaamd de Tangent Lift. Denk aan een machine learning-model als een complexe machine met veel bewegende delen. Meestal kijken we alleen naar de machine wanneer deze normaal functioneert. De Tangent Lift is als het plaatsen van de machine onder een microscoop die niet alleen de onderdelen laat zien, maar ook hoe de onderdelen bewegen wanneer je de machine een beetje schudt.

Het artikel betoogt dat veel huidige machine learning-methoden zijn zoals het rijden in een auto terwijl je alleen naar de snelheidsmeter kijkt. Je weet hoe snel je gaat, maar je weet niet of de motor hapert of dat de wielen er bijna afvallen. LINCS is als het toevoegen van een dashboard dat de trilling van de motor laat zien. Als de trilling ("infinitesimale niet-compositionaliteit") te hoog is, betekent dit dat het ontwerp van de auto gebrekkig is, zelfs als hij op dit moment snel rijdt.

De auteurs definiëren deze "trilling" als een obstructie. In de wiskunde is een obstructie iets dat voorkomt dat een perfecte oplossing bestaat. In LINCS is een obstructie een teken dat de interne logica van het model inconsistent is. Het artikel laat zien dat als een model echt de juiste regels leert, deze obstructies niet alleen moeten verdwijnen voor de hoofdtaken, maar ook voor elke kleine "nudge" van de taak. Als de obstructies blijven bestaan wanneer je het model een duwtje geeft, betekent dit dat het model slechts patronen onthoudt in plaats van de onderliggende structuur te begrijpen.

Van Globale Chaos naar Lokale Oplossingen

Een slim onderdeel van het artikel is hoe het omgaat met grote, rommelige problemen. Stel je voor dat je een enorme, verwarde knoop van wol probeert te ontwarren. Het is moeilijk te zien waar het probleem zit. LINCS suggereert om de knoop op te delen in kleine lussen. Als één kleine lus verward is, los je die specifieke lus op. Het artikel bewijst dat als je alle kleine lussen correct oplost, de grote knoop uiteindelijk zal ontwarren. Dit wordt obstruction localization genoemd.

In de wereld van neurale netwerken (het soort AI dat wordt gebruikt voor zaken als chatbots), betekent dit dat je niet het hele brein tegelijk hoeft te bekken. Je kunt naar slechts één laag van het netwerk kijken, zien of de kleine "nudge" daar een logische breuk veroorzaakt, en die specifieke plek repareren. Het artikel laat zien dat deze methode om kleine stukjes te repareren net zo goed werkt voor de "nudge"-versie van het probleem als voor het oorspronkelijke probleem. Dit is een groot ding, want het betekent dat we betere, stabielere AI kunnen bouwen door deze kleine, verborgen logische breuken te herstellen voordat ze grote fouten veroorzaken.

De "Toren" van het Leren

Het artikel introduceert ook een fascinerend idee genaamd een coalgebraic fixed point. Dit klinkt ingewikkeld, maar het is eigenlijk heel eenvoudig. Stel je voor dat je een ui pelt. Je pelt een laagje, dan nog een laagje, en dan nog een laagje. Normaal gesproken stop je wanneer je de kern bereikt. Maar met LINCS blijf je doorpeelt. Je kijkt naar de kern, en dan kijk je naar de "kern van de kern", enzovoort.

De auteurs suggereren dat een werkelijk perfect leerend model een model is waarbij, nadat je genoeg lagen hebt gepeld (of genoeg "tangent lifts" hebt toegepast), je geen nieuwe problemen meer tegenkomt. De "trilling" of "obstructie" stopt met veranderen. Het model heeft een stabiele staat bereikt. Het artikel gebruikt geavanceerde wiskunde om te bewijzen dat als je dit pelproces blijft voortzetten, je uiteindelijk een punt zult bereiken waarop de logica van het model zo consistent is dat geen enkele hoeveelheid kleine nudges het kan breken. Dit is het "fixed point". Dat is het moment waarop de AI werkelijk de regels van het spel heeft "geleerd", en niet alleen de antwoorden.

Wat het Papier Uitsluit en Wat het Voorstelt

Het is belangrijk om te vermelden wat dit artikel niet zegt. De auteurs beweren niet dat we de oude manier van AI trainen (met eenvoudige scores en verliezen) moeten weggooien. Ze stellen expliciet dat de oude manier krachtig en nuttig is. In plaats daarvan suggereren ze dat de oude manier incompleet is. Ze argumenteren tegen het idee dat een kleine foutscore betekent dat het model perfect is. Een model kan een zeer lage foutscore hebben, maar toch een gebroken interne logica bezitten die zal falen wanneer de echte wereld vreemd doet.

Het artikel sluit ook de mogelijkheid uit dat we geheel nieuwe wiskunde moeten uitvinden om dit op te lossen. In plaats daarvan laten ze zien dat we bestaande wiskundige instrumenten (zoals "tangente categorieën" en "sketches") kunnen gebruiken om het probleem te herformuleren. Ze beweren niet dat ze alle machine learning-problemen al hebben opgelost. Sterker nog, ze geven toe dat hoewel de wiskunde bewijst dat deze "stabiele staten" bestaan, het daadwerkelijk vinden van deze staten in de echte AI (zoals de enorme modellen die verhalen schrijven of auto's besturen) nog steeds een werk in uitvoering is. Ze vermelden dat er momenteel experimenten worden uitgevoerd om te zien of deze theorie in de praktijk werkt voor zaken als grote taalmodellen en reinforcement learning, maar de resultaten van die specifieke experimenten worden beschreven als "bezig" in plaats van voltooid.

De "Lie Bracket" en de Geheime Taal van AI

Een van de meest speelse en diepgaande concepten in het artikel is de Lie bracket. In eenvoudige termen is dit een manier om te meten hoe twee verschillende acties in een machine met elkaar interfereren. Stel je voor dat je danst. Als je naar links draait en dan een stap vooruit zet, eindig je op een andere plek dan wanneer je eerst een stap vooruit zet en dan pas draait. Het verschil tussen die twee uitkomsten is de "Lie bracket".

Het artikel suggereert dat in een goed geleerde AI, deze "danspassen" (of interne operaties) perfect in elkaar moeten passen. Als ze dat niet doen, betekent dit dat de AI in de war is over de volgorde van de dingen. De auteurs laten zien dat we door deze Lie brackets te controleren, de verborgen gebreken kunnen vinden in hoe AI-modellen zaken zoals taal of besluitvorming afhandelen. Als een AI bijvoorbeeld moet begrijpen dat "het door elkaar husselen van woorden in een zin" de betekenis niet mag veranderen, maar dat wel doet, kan de Lie bracket precies detecteren waar die verwarring optreedt.

Waarom Dit Belangrijk Is voor de Toekomst

Dus, waarom zou een nieuwsgierige tiener dit moeten interesseren? Omdat de AI van de toekomst meer moet zijn dan alleen een slimme gokker. Het moet een logisch denker zijn. Als we AI alleen trainen om scores te minimaliseren, eindigen we misschien met modellen die geweldig zijn in het behalen van toetsen, maar verschrikkelijk zijn in het begrijpen van de wereld. Ze kunnen fragiel zijn en instorten zodra er iets onverwachts gebeurt.

LINCS biedt een pad naar het bouwen van AI die robuust en betrouwbaar is. Door de "kleine nudges" te controleren en ervoor te zorgen dat de logica standhoudt onder druk, kunnen we machines creëren die niet alleen menselijk gedrag nabootsen, maar ook de structuur van de problemen die ze oplossen, echt begrijpen. Het artikel suggereert dat de volgende generatie AI niet alleen getraind zal worden op data, maar getraind zal worden op coherentie. Het gaat erom de machine te leren een toren van logica te bouwen die niet wankelt, zelfs niet als de grond beeft.

De auteurs concluderen dat dit framework een nieuwe lens is waardoor we naar machine learning kunnen kijken. Het verandelt het chaotische, ongeordende proces van het trainen van AI in een gestructureerde reis van het repareren van gebroken logica, laag voor laag, totdat de machine een staat van perfect, stabiel begrip bereikt. Hoewel de wiskunde zwaar is, is het idee simpel: controleer niet alleen het antwoord; controleer het denken. En als het denken wankelt bij een klein duwtje, repareer de wankeling voordat je verder gaat.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →