Emergent Models: Intelligence from Tiny Substrates
Dit artikel introduceert Emergent Models, een machine learning-paradigma waarbij eenvoudige, open-eind dynamische substraten zoals cellulaire automaten worden geëvolueerd om taken op te lossen door middel van emergente computationele gedragingen, wat aantoont dat dergelijke minimale systemen latente universaliteit en globale generalisatie kunnen bereiken die verder gaan dan traditionele differentiabele architecturen.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Stel je de wereld van kunstmatige intelligentie voor als een gigantische bibliotheek. Decennialang hebben de bibliothecarissen geprobeerd om de perfecte boekenkast te bouwen. Ze hebben miljoenen boeken (datapunten) op planken (neurale netwerken) gestapeld en de plank geleerd om te raden welk boek er volgt op basis van de boeken die eraan voorafgingen. Dit werkt geweldig als je vraagt naar boeken die ze al hebben gezien, maar als je vraagt naar een verhaal dat nog niet geschreven is, raadt de plank vaak willekeurig of verzint hij onzin. Dit komt omdat de plank heel goed is in het onthouden van patronen, maar slecht in het begrijpen van de regels die het verhaal in de eerste plaats laten werken.
Maak kennis met een ander idee: wat als we, in plaats van een gigantische boekenkast te bouwen, een piepkleine, zelfrijdende robot bouwen die leert problemen op te lossen door rond te bewegen? Dit is de wereld van "Emergent Models" (Emergente Modellen). Denk aan het als een spelletje "Life" gespeeld op een computerscherm. Je hebt een raster van cellen die aan of uit kunnen staan. Je geeft ze een eenvoudige regel, zoals "als twee buren aan staan, zet dan ook deze aan." En dan kijk je wat er gebeurt. Soms ontstaan er ongelooflijk complexe patronen — zoals ruimteschepen of glijders — uit die eenvoudige regels. De grote vraag die wetenschappers stellen is: kunnen we deze kleine, regelgebaseerde robots gebruiken om wiskunde en logica beter te leren begrijpen dan onze gigantische boekenkasten? Kan een systeem met slechts een paar honderd "onderdelen" het geheime recept voor een taart ontdekken, in plaats van alleen maar een lijst met ingrediënten te onthouden? Dit artikel duikt in die vraag en onderzoekt of eenvoudige, evoluerende systemen de sleutel kunnen zijn tot intelligentere, aanpasbaardere AI.
De Kleine Substraten die Denken
De auteurs van dit artikel introduceren een nieuwe manier van denken over machine learning, genaamd Emergent Models (EM's). Stel je voor dat je een leeg canvas hebt (het "substraat") en een enkele, kleine penseel die één eenvoudige regel volgt, zoals "één stap naar rechts bewegen en van kleur veranderen." In traditionele AI proberen we een perfect plaatje te schilderen door miljoenen penseelstreken tegelijkertijd aan te passen. In deze nieuwe aanpak stellen we het canvas en de penseel in, en laten we ze dan een tijdje draaien. We vertellen de penseel niet wat hij moet schilderen; we kijken alleen maar of er na verloop van tijd een patroon ontstaat dat toevallig een probleem oplost, zoals het optellen van twee getallen.
De kern van het idee is dat intelligentie misschien geen massief, complex brein nodig heeft. In plaats daarvan zou het kunnen voortkomen uit een eenvoudig, herhalend proces, net zoals de formatie van een zwerm vogels beweegt zonder dat één vogel bevelen geeft. Het "brein" hier is slechts een kleine set regels die steeds opnieuw wordt uitgevoerd op een raster van data.
De Magie van "Latente Universaliteit"
Het artikel stelt een fascinerend concept voor genaamd Latente Universaliteit. Stel je voor dat je een universele afstandsbediening (het "programma") en een tv (het "substraat") hebt. Bij de meeste AI moet je voor elke andere show die je wilt kijken een nieuwe tv kopen. Maar bij Latente Universaliteit is de tv vast. Je verandert alleen de afstandsbediening (de beginstand van het raster). De auteurs suggereren dat als je het juiste soort tv hebt (een specifiek type wiskundig rooster), je deze theoretisch elk type berekening kunt laten uitvoeren door alleen het beginpatroon op het scherm te veranderen, zonder ooit de interne bedrading van de tv aan te passen.
Ze bewijzen wiskundig dat dit in theorie mogelijk is. Als je een raster hebt dat oneindig doorgaat en een eenvoudige regel, kun je het beginpatroon zo instellen dat het fungeert als een rekenmachine, een schaker of een vertaler. Het "programma" is simpelweg het beginplaatje dat je op het raster tekent.
De Experimenten: Kleine Robots in Actie
Omdat het bouwen van een perfect, oneindig raster moeilijk is, testten de onderzoekers dit idee met een "dierentuin" van kleine, eenvoudige modellen. Ze probeerden geen superintelligente AI te bouwen; ze wilden alleen zien of deze kleine systemen basisregels konden leren en deze vervolgens konden toepassen op grotere getallen.
1. De Wiskundewizzes (EM43)
Ze creëerden een eendimensionale strook cellen (zoals een lange rij dominosteentjes) met een eenvoudige regel. Ze leerden het systeem wiskunde te doen zoals of .
- Het resultaat: Het werkte perfect! Het model leerde de regel op kleine getallen (zoals 1 tot 30) en paste deze vervolgens foutloos toe op enorme getallen (tot 1.000) die het nog nooit had gezien.
- Het "Aha!"-moment: Wanneer ze keken naar hoe het model het probleem oploste, zagen ze prachtige, herhalende geometrische patronen die over het rooster bewogen. Ze noemen dit "geometrische grokking". Het is alsover het model niet alleen het antwoord heeft onthouden, maar een visuele dans heeft ontdekt die werkt voor elk getal. Dit is iets waar traditionele AI moeite mee heeft, vooral met herhalende patronen zoals "wat is de restwaarde bij deling door 4?".
2. Het Spel van het Leven (GoL-EM)
Vervolgens gebruikten ze Conway's Game of Life, een beroemde cellulaire automaat waarbij cellen leven of sterven op basis van hun buren. Ze probeerden dit systeem wiskunde te leren en een staaf te laten balanceren (CartPole).
- Het resultaat: Het kon eenvoudige wiskunde zoals leren, maar het was erg wispelturig. Kleine veranderingen in het beginpatroon zorgden ervoor dat het hele systeem instortte. Het was alsof je een kaartenhuis probeerde te balanceren in een storm. Hoewel het een staaf een tijdje kon balanceren, was het niet erg stabiel. De onderzoekers ontdekten dat het zoeken naar het juiste beginpatroon bijna hetzelfde was als willekeurig gokken; het systeem was zo gevoelig dat het moeilijk te "trainen" was op de gebruikelijke manier.
3. De Continue Leerders (CEM1D & CEM2D)
Ten slotte probeerden ze modellen die gebruikmaken van vloeiende, continue getallen (zoals de echte wereld van de fysica) in plaats van alleen maar "aan/uit"-schakelaars.
- Het resultaat: Deze waren veel beter in het aansturen van zaken. De 1D-versie kon een staaf heel goed balanceren, en de 2D-versie kon leren navigeren in een wereld waar voedsel soms in gif verandert.
- De adder onder het gras: Zelfs deze slimme modellen hadden problemen. Soms bleven ze in cirkels draaien of bevroren ze volledig. Ze leerden zich aan te passen aan de veranderende omgeving, maar ze waren niet perfect. De onderzoekers merkten op dat deze modellen nog erg nieuw zijn en veel minder betrouwbaar zijn dan de grote AI-modellen die we vandaag de dag gebruiken.
Wat dit betekent (en wat het niet betekent)
Het artikel is zeer duidelijk over wat het wel en niet heeft bereikt. Het beweert niet een betere AI te hebben gebouwd dan de AI's die je in films of op je telefoon ziet. Sterker nog, het geeft toe dat deze kleine modellen momenteel veel moeilijker te trainen zijn en minder krachtig zijn dan de grote, complexe modellen.
Het suggereert echter iets spannends: dat de sleutel tot echte intelligentie misschien iteratie is (het herhaaldelijk uitvoeren van een eenvoudige stap) in plaats van omvang (het hebben van miljoenen parameters). De auteurs ontdekten dat wanneer deze kleine modellen wel leerden, ze de regel leerden, en niet alleen het antwoord. Dit stelde hen in staat om correct te voorspellen bij getallen die ze nog nooit hadden gezien, een vaardigheid die extrapolatie wordt genoemd.
Ze introduceren ook een nieuwe manier van denken over AI-efficiëntie. Ze suggereren dat de beste modellen diegenen kunnen zijn die heel weinig "harde" onderdelen (de regels) gebruiken, maar deze gedurende een lange tijd laten draaien (veel stappen). Dit is het tegenovergestelde van de huidige grote AI, die een enorme hoeveelheid "harde" onderdelen gebruikt, maar deze slechts één keer uitvoert.
De Conclusie
Dit artikel is een fundamentele stap, zoals de eerste keer dat iemand een werkende stoommachine bouwde. Het is nog geen auto en het is zeker geen ruimteschip. Maar het bewijst dat een eenvoudig, herhalend systeem regels kan leren en deze kan toepassen op nieuwe situaties. De onderzoekers laten zien dat met slechts een paar honderd parameters een systeem regels kan leren en eenvoudige robots kan besturen.
De belangrijkste les is dat we AI misschien te ingewikkeld maken. In plaats van steeds grotere en grotere hersenen te bouwen, moeten we misschien kleinere, eenvoudigere systemen bouwen die de ruimte krijgen om langer na te denken. Het artikel suggereert dat het pad naar intelligentere AI kan liggen in deze "emergente" gedragingen, waarbij intelligentie voortkomt uit eenvoudige regels, net zoals leven voortkomt uit eenvoudige chemie. Het is een hoopvolle, speelse en enigszins wilde gedachte dat de toekomst van intelligentie te vinden kan zijn in de kleinste, eenvoudigste dingen.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.