← Nieuwste papers
📊 statistics

SPINEX_ Symbolic Regression: Similarity-based Symbolic Regression with Explainable Neighbors Exploration

Dit artikel introduceert SPINEX_SymbolicRegression, een nieuw op gelijkenis gebaseerd algoritme voor symbolische regressie dat gebruikmaakt van uitlegbare nabijheidsexploratie om hoogwaardige expressies te identificeren, waarbij het een concurrerende nauwkeurigheid en structurele gelijkenis demonstreert ten opzichte van leidende methoden over meer dan 180 benchmarkfuncties.

Oorspronkelijke auteurs: MZ Naser, Ahmed Z Naser

Gepubliceerd 2026-08-21
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: MZ Naser, Ahmed Z Naser

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

In het uitgestrekte landschap van de moderne wetenschap is data overal. Sensoren op bruggen, telescopen in de ruimte en instrumenten in laboratoria genereren eindeloze stromen getallen die beschrijven hoe de wereld werkt. Decennialang was de standaardmanier om deze data te begrijpen het gebruik van machine learning-modellen die fungeren als krachtige 'black boxes'. Deze systemen zijn uitstekend in het voorspellen wat er hierna zal gebeuren; ze kunnen een storm voorspellen of een ziekte identificeren met een hoge nauwkeurigheid. Ze falen echter vaak in het verklaren van waarom ze die voorspelling hebben gedaan. Ze bieden een resultaat zonder een reden, waardoor wetenschappers achterblijven met een correct antwoord maar zonder begrip van het onderliggende mechanisme.

Hier komt een andere aanpak, bekend als symbolische regressie, in beeld. In tegenstelling tot traditionele methoden die data in een vooraf ingestelde vorm dwingen, werkt symbolische regressie meer als een nieuwsgierige ontdekkingsreiziger. Het zoekt naar de werkelijke wiskundige zin die de relatie tussen variabelen beschrijft. In plaats van alleen een getal te raden, probeert het de vergelijking zelf te schrijven, waarbij het de formule ontdekt die de data beheerst. Het doel is niet alleen om te voorspellen, maar om de verborgen wetten van de natuur te onthullen op een manier die een mens kan lezen, begrijpen en verifiëren. Dit vermogen om transparante, uitlegbare modellen te produceren is cruciaal voor velden zoals natuurkunde en techniek, waar weten waarom net zo belangrijk is als weten wat.

Voortbouwend op deze behoefte aan helderheid, heeft een team van onderzoekers een nieuw algoritme ontwikkeld genaamd SPINEX_SymbolicRegression. Dit hulpmiddel is ontworpen om deze wiskundige zinnen effectiever te vinden door gebruik te maken van een concept dat gelijkenis (similarity) wordt genoemd. Stel je voor dat het algoritme op zoek is naar een specifiek type boom in een uitgestrekt bos. In plaats van elke boom afzonderlijk te bekijken, vergelijkt het ze met elkaar. Het vraagt: "Lijkt deze nieuwe boom op de bomen die het al goed doen?" Door zich te concentreren op expressies die structureel lijken op veelbelovende kandidaten, kan het algoritme de zoekruimte intelligenter navigeren. Het zoekt niet alleen naar het antwoord dat het beste bij de cijfers past; het zoekt ook naar antwoorden die dezelfde bouwstenen delen — zoals dezelfde variabelen en operaties — als de meest succesvolle modellen die het tot nu toe heeft gevonden.

De onderzoekers testten deze nieuwe methode tegen een enorme collectie van 182 verschillende wiskundige problemen. Deze problemen varieerden van eenvoudige, willekeurig gegenereerde vergelijkingen tot complexe formules afgeleid van reële fysische verschijnselen, zoals de wetten van beweging en thermodynamica. Ze zetten hun nieuwe algoritme af tegen PySR, een toonaangevend hulpmiddel in dit vakgebied, en draaiden duizenden simulaties om te zien welk algoritme vaker de juiste wiskundige expressie zou vinden. De resultaten toonden een duidelijk voordeel voor de nieuwe aanpak in specifieke gebieden. Hoewel het gevestigde hulpmiddel soms antwoorden vond die iets nauwkeuriger waren in termen van ruwe voorspelling, was het nieuwe algoritme superieur in het vinden van de juiste ingrediënten. Het was veel waarschijnlijker om de juiste set variabelen en de juiste wiskundige operaties te identificeren die nodig zijn om het systeem te beschrijven. In veel gevallen, wanneer de onderzoekers vereisten dat het algoritme alle beschikbare variabelen gebruikte, bereikte de nieuwe methode een perfecte match, waarbij het de exacte structuur van de ware vergelijking veel vaker vond dan zijn concurrent.

Een kernkenmerk van dit werk is de focus op uitlegbaarheid. De onderzoekers wilden niet alleen een black box die werkt; ze wilden zien hoe het algoritme dacht. Ze hebben tools opgenomen waarmee gebruikers precies kunnen zien hoe het algoritme zijn oplossingen evolueerde, welke variabelen het belangrijk vond, en hoe sterk de beste gissingen leken op de werkelijke onderliggende wetten. In één demonstratie werd het algoritme gevraagd de formule voor een eenvoudige curve te vinden. Het slaagde erin een expressie te evolueren die nauw aansloot bij het doel, en het systeem leverde een gedetailleerde analyse van waarom bepaalde delen van de formule beter werkten dan andere. Dit niveau van transparantie stelt wetenschappers in staat om het model te vertrouwen, niet alleen omdat het goed voorspelt, maar omdat ze de logica erachter kunnen zien.

De studie concludeert dat deze op gelijkenis gebaseerde aanpak een krachtige nieuwe manier biedt om wiskundige relaties te ontdekken. Door de balans te zoeken tussen de behoefte aan nauwkeurigheid en de behoefte aan structurele gelijkenis, produceerde het algoritme consistent modellen die zowel precies als begrijpelijk waren. De onderzoekers merkten op dat, hoewel de methode zeer effectief is, het aanzienlijke rekenkracht vereist en dat er nog ruimte is om de snelheid waarmee deze gelijkenissen worden berekend te verbeteren. De bevindingen suggereren echter dat wetenschappers, door de zoektocht te sturen met het principe van gelijkenis, modellen kunnen genereren die niet alleen accuraat zijn, maar ook in lijn zijn met de fundamentele principes van de fysieke wereld. Dit brengt het veld van machine learning een stap dichter bij een toekomst waarin computers niet alleen de toekomst kunnen voorspellen, maar ook de regels kunnen uitleggen die het beheersen.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →