← Nieuwste papers
🤖 machine learning

Decomposable Neural Symbolic Regression

Dit artikel introduceert een decomponeerbare neurale symbolische regressiemethode die Multi-Set Transformers, genetische algoritmen en genetische programmering benut om opaak geregresseerde modellen te distilleren tot nauwkeurige, interpreteerbare multivariate expressies die consistent de oorspronkelijke wiskundige structuur herstellen terwijl ze een concurrerende voorspellende prestatie behouden.

Oorspronkelijke auteurs: Giorgio Morales, John W. Sheppard

Gepubliceerd 2026-08-25
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Giorgio Morales, John W. Sheppard

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

In de moderne wereld van de wetenschap zijn computers ongelooflijk krachtige instrumenten geworden voor het vinden van patronen in gegevens. Ze kunnen duizenden metingen uit de natuurlijke wereld bestuderen en complexe modellen bouwen die toekomstige uitkomsten met een hoge nauwkeurigheid voorspellen. Deze modellen worden vaak "opaak" genoemd omdat, hoewel ze goed werken, hun interne logica zo verstrengeld en ingewikkeld is dat mensen niet gemakkelijk kunnen begrijpen hoe ze tot hun conclusies komen. Ze zijn als een zwarte doos: je stopt er gegevens in, en er komt een antwoord uit, maar het pad daartussen blijft verborgen. Voor wetenschappers die natuurkunde, biologie of techniek bestuderen, is dit gebrek aan transparantie een grote hindernis. Om de natuur werkelijk te begrijpen, hebben onderzoekers meer nodig dan alleen een voorspelling; ze hebben de onderliggende vergelijkingen nodig, de heldere wiskundige zinnen die beschrijven hoe de natuur werkt. Dit is het doel van symbolische regressie, een vakgebied dat zich richt op het vinden van eenvoudige, leesbare formules die geobserveerde gegevens verklaren, in plaats van ze alleen maar te memoriseren.

Een team onderzoekers aan de Montana State University heeft een nieuwe manier ontwikkeld om dit probleem aan te pakken, een methode die de lagen van deze complexe computermodellen kan afpellen om de eenvoudige wiskundige waarheden eronder te onthullen. Hun benadering, die ze SeTGAP noemen, begint met het trainen van een standaard, zeer complex computermodel om het gedrag van een systeem te leren. Zodra dit "opaak" model getraind is en werkt, proberen de onderzoekers niet de miljoenen interne instellingen ervan terug te ontwerpen. In plaats daarvan behandelen ze het model als een bron van waarheid en vragen ze het om zichzelf uit te leggen, één variabele tegelijk. Ze isoleren systematisch elke invoerfactor, zoals temperatuur of druk, en vragen het model hoe de output verandert wanneer slechts die ene factor beweegt. Door dit te doen, genereert het systeem een reeks eenvoudige, enkelvoudige schetsen die de vorm van de relatie voor elk deel van de puzzel beschrijven.

De onderzoekers gebruiken vervolgens een geavanceerd proces om deze individuele schetsen aan elkaar te naaien. Stel je voor dat je probeert een complexe machine te begrijpen door eerst uit te zoeken hoe elk tandwiel op zichzelf draait, en dan te zien hoe ze in elkaar grijpen. Het team gebruikt een combinatie van kunstmatige intelligentie en evolutionaire algoritmen om deze enkelvoudige schetsen samen te voegen tot een volledige, multivariabele formule. Ze gooien niet simpelweg alle stukjes tegelijk bij elkaar, wat vaak leidt tot verwarring en overdreven complexe resultaten. In plaats daarvan voegen ze variabelen één voor één toe, waarbij ze ervoor zorgen dat de structuur van de formule in elke stap helder en logisch blijft. Deze methode stelt hen in staat om de oorspronkelijke functionele relaties die zij vroegtijdig identificeerden te behouden, waardoor wordt voorkomen dat de uiteindelijke vergelijking een rommelige wirwar van getallen wordt die weliswaar de gegevens past, maar geen zin maakt.

Toen het team deze methode testte tegen een breed scala aan problemen, van synthetische wiskundige uitdagingen tot echte natuurkundige vergelijkingen, waren de resultaten opmerkelijk. Op de synthetische problemen slaagde hun methode erin om de correcte wiskundige structuur van het onderliggende systeem in elk geteste geval te herstellen. In contrast hiermee faalden andere toonaangevende methoden, inclusief die die vertrouwen op deep learning of traditionele evolutionaire computing, regelmatig in het vinden van de juiste vorm; ze produceerden vaak expressies die ofwel te complex waren of simpelweg fout waren, zelfs als ze de getallen correct voorspelden. De nieuwe aanpak bleek bijzonder robuust wanneer de gegevens ruis of fouten bevatten, een veelvoorkomend verschijnsel bij echte metingen. Terwijl andere methoden moeite hadden om te generaliseren buiten de gegevens waarop ze getraind waren, hielden de door deze methode ontdekte vergelijkingen goed stand bij testen op nieuwe, ongeziene bereiken van waarden.

De onderzoekers pasten hun techniek ook toe op een beroemde collectie natuurkundige vergelijkingen bekend als de Feynman-dataset, die wetten bevat die alles beschrijven, van zwaartekracht tot het gedrag van licht. Op deze benchmark behaalde hun methode een hoog succespercentage in het identificeren van de juiste vergelijkingen, waarbij ze tweede werd in de succesvolle herwinning van symbolische oplossingen met ongeveer 61,2%, en toonde het een concurrerende voorspellende prestatie ten opzichte van vele gevestigde technieken. De studie suggereert dat door een complex probleem op te splitsen in kleinere, beheersbare delen en deze vervolgens zorgvuldig weer in elkaar te zetten, het mogelijk is om de beperkingen van de huidige kunstmatige intelligentie te omzeilen. Dit betekent niet dat de computers minder krachtig zijn; het betekent dat de methode om hen zichzelf te laten uitleggen effectiever is. Het werk laat zien dat het mogelijk is om heldere, voor mensen leesbare natuurwetten te extraheren uit de diepe, verborgen lagen van moderne machine learning, waardoor opaak voorspellende modellen worden omgezet in transparant begrip.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →