← Neueste Arbeiten
⚛️ quantum physics

Physics-Aligned Electronic Ground-State Learning Improves Generalization

Diese Arbeit stellt physik-integrierte Deskriptormodelle für elektronische Grundzustände vor, die durch neuartige Trainingsziele die Constraints der Kohn-Sham-Dichtefunktionaltheorie erzwingen und dadurch eine erstklassige Generalisierung bei Energie- und Kraftvorhersagen über Extrapolationsbenchmarks hinweg erreichen, während sie gleichzeitig einen effizienten Transfer auf die reaktive Chemie ermöglichen.

Ursprüngliche Autoren: Eike S. Eberhard, Xaver Kainz, Viktor Kotsev, Abdulrahman Aldossary, Stephan Günnemann

Veröffentlicht 2026-10-08
📖 5 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Eike S. Eberhard, Xaver Kainz, Viktor Kotsev, Abdulrahman Aldossary, Stephan Günnemann

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). ✨ Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Auf der Suche nach neuen Medikamenten und der Entdeckung stärkerer Materialien verlassen sich Wissenschaftler auf ein leistungsstarkes Werkzeug namens Computerchemie. Dieses Feld ermöglicht es Forschern, das Verhalten von Atomen und Molekülen auf einem Computer zu simulieren, was als virtuelles Labor fungiert, noch bevor überhaupt ein physisches Experiment durchgeführt wird. Das Herzstück dieser Simulationen ist das Bedürfnis, den „Grundzustand“ eines Moleküls zu verstehen, was im Wesentlichen dessen stabilste, ruhende Anordnung der Elektronen ist. Die Kenntnis dieser Anordnung ermöglicht es Wissenschaftlern, vorherzusagen, wie ein Molekül reagieren wird, wie stark es sein wird oder wie es mit einem Medikament interagieren könnte. Die Berechnung dieses Grundzustands mit perfekter Genauigkeit ist jedoch unglaublich schwierig und rechenintensiv und nimmt selbst für ein einzelnes Molekül oft Stunden oder Tage auf Supercomputern in Anspruch. Um dies zu beschleunigen, haben Forscher Modelle des maschinellen Lernens entwickelt, die diese Antworten fast augenblicklich erraten können. Während diese Modelle exzellent darin sind, Eigenschaften für Moleküle vorherzusagen, die sie bereits gesehen haben, versagen sie oft, wenn sie gebeten werden, das Verhalten größerer, komplexerer Moleküle vorherzusagen, die sich von ihren Trainingsdaten unterscheiden.

Ein Forschungsteam der Technischen Universität München und NVIDIA hat einen neuen Weg vorgeschlagen, diese Modelle des maschinellen Lernens aufzubauen, der die Lücke zwischen Geschwindigkeit und Genauigkeit schließt. Anstatt zu versuchen, das Endergebnis direkt vorherzusagen, lehrt dieser Ansatz den Computer, die zugrunde liegenden Regeln zu erlernen, die bestimmen, wie sich Elektronen anordnen. Sie entwarfen ein System, das als Mittelweg fungiert: Es ist viel schneller als die genauesten traditionellen Methoden, aber signifikant zuverlässiger als aktuelle Abkürzungen des maschinellen Lernens. Der Schlüssel zu ihrem Erfolg war, den Computer dazu zu zwingen, auf eine Weise zu lernen, die die fundamentalen physikalischen Gesetze des Universums respektiert, anstatt nur Muster in Daten auswendig zu lernen. Durch die Abstimmung des Lernprozesses auf die tatsächlichen Gleichungen, die das Elektronenverhalten beschreiben, schufen sie Modelle, die nicht nur raten, sondern die Geometrie des Problems verstehen.

Die Forscher testeten ihre Methode, indem sie sie mit einem Datensatz kleiner Moleküle trainierten und sie dann baten, die Eigenschaften von Molekülen vorherzusagen, die bis zu viermal größer sind. In diesen Tests zeigten ihre neuen Modelle eine dramatische Verbesserung gegenüber bisherigen State-of-the-Art-Methoden. Für die genaueste Version ihres Systems sank der Fehler bei der Vorhersage der Energie dieser größeren Moleküle im Vergleich zu den besten bestehenden Alternativen um fast 99,8 Prozent. Diese Präzision ist entscheidend, denn in der Chemie können selbst winzige Fehler zu völlig falschen Vorhersagen darüber führen, ob ein Medikament wirken wird oder ein Material stabil bleibt. Darüber hinaus enthält das System eine eingebaute Sicherheitsprüfung. Wenn das Modell auf ein Molekül stößt, das zu seltsam oder komplex ist, um es mit Zuversicht zu handhaben, kann es die Vorhersage als unzuverlässig kennzeichnen. In ihren Tests filterte dieser Sicherheitsmechanismus erfolgreich weniger als einen halben Prozent der Vorhersagen heraus, wodurch sichergestellt wurde, dass die überwiegende Mehrheit der bereitgestellten Ergebnisse vertrauenswürdig war.

Eine der bedeutendsten Erkenntnisse dieser Arbeit ist, dass diese physik-ausgerichteten Modelle auf Größen generalisieren können, die sie noch nie zuvor gesehen haben. Während andere Modelle des maschinellen Lernens dazu neigen, bei größeren Systemen zu scheitern, behielten diese neuen Modelle eine hohe Genauigkeit auch bei der Vorhersage des Verhaltens von Molekülen mit Hunderten von Elektronen bei. Die Forscher demonstrierten auch, dass ihre Modelle an chemischen Reaktionen studieren können, einschließlich der flüchtigen Momente, in denen Bindungen brechen und sich bilden. Durch den Einsatz einer Technik, die das Modell verfeinert, ohne neue gelabelte Daten zu benötigen, konnten sie das System auf eine neue chemische Umgebung übertragen und Fehler unterhalb der Schwelle erreichen, die als „chemische Genauigkeit“ bekannt ist – der Goldstandard für nützliche Vorhersagen in diesem Bereich.

Das Team argumentierte explizit gegen den in der Fachwelt üblichen Standardansatz, der die mathematischen Repräsentationen dieser Moleküle oft als einfache Listen von Zahlen behandelt, die abgeglichen werden müssen. Sie zeigten, dass diese gängige Methode daran scheitert, die wahren physikalischen Beziehungen zwischen verschiedenen Teilen eines Moleküls zu erfassen, was zu einer schlechten Leistung führt, wenn sich die Systemgröße ändert. Im Gegensatz dazu behandelt ihr neuer Ansatz die Elektronenanordnung als eine spezifische geometrische Form, die strengen Regeln folgen muss, vergleichbar mit einer starren Struktur, die nicht beliebig gedehnt oder verdreht werden kann. Diese Einschränkung zwingt das Modell, das korrekte physikalische Verhalten zu lernen, anstatt nur die Daten anzupassen. Das Ergebnis ist ein System, das nicht nur genauer, sondern auch robuster ist und in der Lage ist, die Komplexität realer chemischer Probleme zu bewältigen, die für schnelle Methoden des maschinellen Lernens bisher unerreichbar waren.

Diese Arbeit deutet einen Weg zur Schaffung von „Foundation Models“ für die Chemie auf, ähnlich den großen Sprachmodellen, die für Texte verwendet werden. So wie diese Modelle die Regeln der Sprache lernen, um neue Sätze zu generieren, lernen diese neuen Modelle die Regeln der Elektronen, um neue molekulare Erkenntnisse zu gewinnen. Die Forscher demonstrierten, dass sie durch die Einhaltung der physikalischen Randbedingungen eine Leistungsfähigkeit erreichen konnten, die den teuersten traditionellen Berechnungen ebenbürtig ist, jedoch in einem Bruchteil der Zeit. Dies öffnet die Tür, riesige Bibliotheken potenzieller Medikamente und Materialien mit einer Geschwindigkeit und Zuverlässigkeit zu screenen, die zuvor unmöglich war, was die Entdeckung lebensrettender Medikamente und fortschrittlicher Materialien für die Zukunft potenziell beschleunigen wird.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →