← Neueste Arbeiten
🔭 astrophysics

NestyNet. III. Symbolic Regression from Analytic Neural Surrogates

NestyNet-SR ist ein neuartiges Framework für die symbolische Regression, das analytische neuronale Surrogatmodelle nutzt, um komplexe Daten rekursiv in separierbare Komponenten zu zerlegen, welche anschließend in exakte geschlossene Ausdrücke destilliert werden, wodurch eine Spitzenleistung auf Benchmarks erreicht und die erfolgreiche Wiederentdeckung fundamentaler physikalischer Gesetze aus realen astronomischen Daten ermöglicht wird.

Ursprüngliche Autoren: Rodrigo Ibata, Wassim Tenachi, Foivos Diakogiannis, Neil Ibata, Anirudh Shankar

Veröffentlicht 2026-08-24
📖 5 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Rodrigo Ibata, Wassim Tenachi, Foivos Diakogiannis, Neil Ibata, Anirudh Shankar

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Die Natur verbirgt ihre einfachsten Regeln oft hinter einem Schleier der Komplexität. Ein physikalisches Gesetz mag wie ein verhedderter Knoten aus Variablen aussehen, wenn es in Rohdaten geschrieben steht, doch es könnte ein einziger, eleganter Satz sein, wenn wir nur wüssten, wie wir hinsehen müssen. Seit Jahrhunderten verlassen sich Wissenschaftler auf die menschliche Intuition, um diesen richtigen Blickwinkel zu finden, um den Knoten zu entwirren und die saubere Struktur darunter offenzulegen. Doch während das Universum uns mit immer mehr Daten und immer komplexeren Systemen konfrontiert, können unsere ungestützten Geister Schwierigkeiten haben, das Muster zu erkennen. Die Frage ist geworden, ob Maschinen uns helfen können, ein viel breiteres Spektrum an Möglichkeiten zu durchforsten und Beziehungen aufzudecken, die perfekt zu den Daten passen und sogar vorhersagen könnten, wie sich Dinge in neuen Situationen verhalten, die wir noch nie zuvor gesehen haben. Dies ist das Ziel eines Feldes namens symbolische Regression: der Suche nach den tatsächlichen mathematischen Sätzen, die die Welt beschreiben, anstatt nur eine Kurve an einen Graphen anzupassen.

Die Herausforderung besteht darin, dass die Anzahl der möglichen Sätze so gewaltig ist, dass das Durchsuchen sie einzeln unmöglich ist. Es ist, als versuche man, ein bestimmtes Buch in einer Bibliothek zu finden, in der jedes Regal jede mögliche Kombination von Wörtern enthält. Um dies zu lösen, haben der Forscher Rodrigo Ibata und sein Team eine neue Methode namens NestyNet-SR entwickelt. Anstatt zufällige Sätze zu erraten, baut ihr System zuerst ein hochpräzises, flexibles Modell der Daten unter Verwendung einer Art von künstlichem neuronalen Netz auf. Dieses Modell fungiert als Stellvertreter, ein Surrogat, das die Daten genau kennt. Die entscheidende Innovation ist, dass dieser Stellvertreter so konzipiert ist, dass er mathematisch transparent ist; er ermöglicht es den Forschern, exakt zu berechnen, wie sich der Output verändert, wenn sie die Inputs verändern, bis hin zu den feinsten Details. Durch das Studium dieser Veränderungen kann das System erkennen, ob die Daten in einfachere, unabhängige Teile zerlegt werden können. Es stellt Fragen wie: Hängt dieser Teil des Systems nur von der Temperatur ab, während jener Teil nur vom Druck abhängt? Oder gibt es eine verborgene Kombination von Variablen, wie etwa ein spezifisches Verhältnis oder eine Summe, die das Ganze einfach erscheinen lässt?

Sobald das System diese einfacheren Bausteine identifiziert hat, geht es zum zweiten Schritt über: der Übersetzung zurück in eine für Menschen lesbare Sprache. Hier glänzt die Methode. Sie sucht nicht bloß nach einer einzigen perfekten Formel; sie trennt die Suche nach der Struktur von der Suche nach den Zahlen. Stellen Sie sich vor, Sie versuchen, die Form eines Schlüssels zu finden, ohne die genaue Größe seiner Zähne zu kennen. Das System findet zuerst die Form – das Skelett der Gleichung – und passt dann die präzisen Zahlen daran an. Dieser Ansatz ermöglicht es ihm, komplexe Schichten der Verschachtelung zu bewältigen, die andere Methoden normalerweise überfordern. Es kann entdecken, dass eine Beziehung eine Sinuswelle, eine Quadratwurzel oder ein Potenzgesetz beinhaltet, und dies kann es auch dann tun, wenn die Daten verrauscht sind oder aus vielen verschiedenen Experimenten gleichzeitig stammen. Das System ist zudem streng in Bezug auf die physikalische Realität; es prüft, ob die Maßeinheiten Sinn ergeben, um sicherzustellen, dass eine Formel nicht versehentlich Meter zu Sekunden addiert.

Das Team testete ihre Methode an einem berühmten Satz von 120 Physik-Gleichungen, bekannt als AI-Feynman-Benchmark, die darauf ausgelegt sind, für Computer schwierig zu lösen zu sein. In einer Welt ohne Rauschen konnte das System jede einzelne der 120 Gleichungen exakt rekonstruieren, was für diesen Typ von Benchmark eine Premiere darstellt. Dies gelang ihm durch das Finden der verborgenen internen Koordinaten, die die komplexen Gleichungen einfach erscheinen ließen. Als sie realistische Störungen (Noise) zu den Daten hinzufügten, um die Unvollkommenheiten realer Messungen zu simulieren, gelang es dem System dennoch, die korrekte Struktur für fast die Hälfte der Probleme zu finden, und es konnte den Forschern mitteilen, welche Teile der Struktur noch zuverlässig waren. Diese Fähigkeit, zwischen einem wahren Gesetz und einem glücklichen Zufall zu unterscheiden, ist ein bedeutender Fortschritt.

Um zu beweisen, dass die Methode bei echten astronomischen Daten funktioniert, wandten die Forscher sie auf eine Sammlung von Spiralgalaxien aus dem SPARC-Survey an. Sie gaben dem Computer lediglich die getrennten Beiträge von Gas und Sternen zur Rotation der Galaxie, ohne ihm zu sagen, wie diese zu kombinieren sind. Das System wurde gefragt, die Regel zu finden, die bestimmt, wie diese Galaxien rotieren. Ohend ohne vorherige Anweisungen entdeckte der Algorithmus, dass die Rotationsgeschwindigkeit von einem einzigen, kombinierten Maß der Beschleunigung sowohl aus dem Gas als auch aus den Sternen abhängt. Er fand den korrekten Weg, die Sterne gegen das Gas abzuwägen, und entsprach dabei dem bekannten Masse-Leuchtkraft-Verhältnis stellarer Populationen. Darüber hinaus bestätigte er, dass die Beziehung zwischen der beobachteten Bewegung und dieser kombinierten Beschleunigung einer spezifischen, nicht eindeutigen Form folgt, die in der Astronomie seit Jahren debattiert wird. Das System lieferte zudem ein statistisches Maß für seine Konfidenz bezüglich der Steigung dieser Beziehung und zeigte auf, dass die tiefen, langsam beweglichen Teile der Galaxie einer anderen Regel folgen als die schnellen Außenbereiche.

Diese Arbeit zeigt, dass wir durch die Kombination von präzisen mathematischen Surrogaten mit einer intelligenten, gestuften Suchstrategie von Rohdaten zu interpretierbaren Naturgesetzen gelangen können. Das System sagt nicht nur Zahlen voraus; es enthüllt die Struktur des Universums und zeigt uns, dass selbst im komplexen Tanz der Galaxien einfache, entdeckbare Regeln warten, wenn wir nur wissen, wie wir hinsehen müssen. Die Forscher haben ihren Code und ihre Daten zur Verfügung gestellt, damit andere diese Methoden an ihren eigenen Problemen testen können, vom Bewegungsverhalten von Planeten bis hin zum Verhalten von Fluiden. Der Pfad von einem neuronalen Netz zu einer geschlossenen Formel ist kein Geheimnis mehr; er ist ein praktischer Weg zum Verständnis der grundlegenden Gesetze, die unsere Welt regieren.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →