← Ultimi articoli
📊 statistics

SPINEX_ Symbolic Regression: Similarity-based Symbolic Regression with Explainable Neighbors Exploration

Questo articolo introduce SPINEX_SymbolicRegression, un nuovo algoritmo di regressione simbolica basato sulla similitudine che sfrutta l'esplorazione spiegabile dei vicini per identificare espressioni ad alto merito, dimostrando un'accuratezza e una similitudine strutturale competitive rispetto ai metodi leader attraverso oltre 180 funzioni di benchmark.

Autori originali: MZ Naser, Ahmed Z Naser

Pubblicato 2026-08-21
📖 4 min di lettura☕ Lettura da pausa caffè

Autori originali: MZ Naser, Ahmed Z Naser

Articolo originale sotto licenza CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Questa è una spiegazione generata dall'IA dell'articolo qui sotto. Non è stata scritta né approvata dagli autori. Per precisione tecnica, consulta l'articolo originale. Leggi il disclaimer completo

Nel vasto panorama della scienza moderna, i dati sono ovunque. Sensori sui ponti, telescopi nello spazio e strumenti nei laboratori generano flussi infiniti di numeri che descrivono come funziona il mondo. Per decenni, il modo standard per dare un senso a questi dati è stato quello di utilizzare modelli di apprendimento automatico che agiscono come potenti scatole nere. Questi sistemi sono eccellenti nel prevedere cosa accadrà dopo; possono prevedere una tempesta o identificare una malattia con un'elevata precisione. Tuttavia, spesso non riescono a spiegare perché abbiano fatto quella previsione. Offrono un risultato senza una ragione, lasciando agli scienziati una risposta corretta ma senza la comprensione del meccanismo sottostante.

È qui che entra in gioco un approccio diverso, noto come regressione simbolica. A differenza dei metodi tradizionali che costringono i dati in una forma preimpostata, la regressione simbolica agisce più come un esploratore curioso. Cerca la reale frase matematica che descrive la relazione tra le variabili. Invece di limitarsi a indovinare un numero, cerca di scrivere l'equazione stessa, scoprendo la formula che governa i dati. L'obiettivo non è solo prevedere, ma rivelare le leggi nascoste della natura in un modo che sia leggibile, comprensibile e verificabile da un essere umano. Questa capacità di produrre modelli trasparenti ed esplicabili è fondamentale in campi come la fisica e l'ingegneria, dove conoscere il "perché" è importante quanto conoscere il "cosa".

Costruendo su questa necessità di chiarezza, un team di ricercatori ha sviluppato un nuovo algoritmo chiamato SPINEX_SymbolicRegression. Questo strumento è progettato per trovare queste frasi matematiche in modo più efficace utilizzando un concetto chiamato somiglianza. Immaginate che l'algoritmo stia cercando un tipo specifico di albero in una vasta foresta. Invece di guardare ogni singolo albero isolatamente, li confronta tra loro. Chiede: "Questo nuovo albero assomiglia a quelli che stanno già andando bene?". Concentrandosi su espressioni strutturalmente simili a candidati promettenti, l'algoritmo può navigare nello spazio di ricerca in modo più intelligente. Non cerca solo la risposta che si adatta meglio ai numeri; cerca anche risposte che condividano gli stessi blocchi costruttivi — come le stesse variabili e operazioni — dei modelli più riusciti trovati finora.

I ricercatori hanno testato questo nuovo metodo contro una vasta collezione di 182 diversi problemi matematici. Questi problemi variavano da equazioni semplici, generate casualmente, a formule complesse derivate da fenomeni fisici reali, come le leggi del moto e la termodinamica. Hanno messo il loro nuovo algoritmo contro PySR, uno strumento leader nel campo, eseguendo migliaia di simulazioni per vedere quale dei due riuscisse a trovare l'espressione matematica corretta più spesso. I risultati hanno mostrato un vantaggio distinto per il nuovo approccio in aree specifiche. Mentre lo strumento consolidato trovava talvolta risposte leggermente più accurate in termini di pura previsione, il nuovo algoritmo era molto superiore nel trovare gli ingredienti giusti. Era molto più probabile che identificasse l'insieme corretto di variabili e le corrette operazioni matematiche necessarie per descrivere il sistema. In molti casi, quando i ricercatori richiedevano all'algoritmo di utilizzare tutte le variabili disponibili, il nuovo metodo otteneva un match perfetto, trovando l'esatta struttura della vera equazione molto più spesso del suo concorrente.

Una caratteristica chiave di questo lavoro è il suo focus sulla spiegabilità. I ricercatori non volevano solo una scatola nera che funzionasse; volevano vedere come l'algoritmo pensasse. Hanno incluso strumenti che permettono agli utenti di vedere esattamente come l'algoritmo abbia evoluto le sue soluzioni, quali variabili ha considerato importanti e quanto le sue migliori ipotesi fossero simili alle vere leggi sottostanti. In una dimostrazione, l'algoritmo è stato chiamato a trovare la formula per una curva semplice. È riuscito a evolvere un'espressione che corrispondeva strettamente all'obiettivo, e il sistema ha fornito una scomposizione dettagliata del perché certe parti della formula funzionassero meglio di altre. Questo livello di trasparenza permette agli scienziati di fidarsi del modello, non solo perché predice bene, ma perché possono vedere la logica che lo sostiene.

Lo studio conclude che questo approccio basato sulla somiglianza offre un nuovo e potente modo per scoprire le relazioni matematiche. Bilanciando la necessità di accuratezza con la necessità di somiglianza strutturale, l'algoritmo ha prodotto costantemente modelli che erano sia precisi che comprensibili. I ricercatori hanno osservato che, sebbene il metodo sia altamente efficace, richiede una potenza di calcolo significativa e c'è ancora spazio per migliorare la velocità con cui può calcolare queste somiglianze. Tuttavia, i risultati suggeriscono che, guidando la ricerca con il principio della somiglianza, gli scienziati possono generare modelli che non siano solo accurati, ma anche allineati con i principi fondamentali del mondo fisico. Questo porta il campo dell'apprendimento automatico un passo più vicino a un futuro in cui i computer possano non solo prevedere il futuro, ma anche spiegare le regole che lo governano.

Sommerso dagli articoli nel tuo campo?

Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.

Prova Digest →