← Neueste Arbeiten
🤖 machine learning

Mol-JEPA: A multimodal Joint Embedding Predictive Architecture for Molecules

Mol-JEPA ist ein skalierbares multimodales Framework, das molekulare Weltmodelle lernt, indem es Modality Masking über diverse Daten der Wirkstoffforschung anwendet, um Einschränkungen wie chemisch ungültige Augmentationen und Modality Collapse zu überwinden und dadurch durch latente Raumvorhersage robuste Repräsentationen zu generieren.

Ursprüngliche Autoren: Florian Rottach, Sebastian Schieferdecker, William Rudman, Randall Balestriero, Carsten Eickhoff

Veröffentlicht 2026-08-25
📖 6 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Florian Rottach, Sebastian Schieferdecker, William Rudman, Randall Balestriero, Carsten Eickhoff

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Die Suche nach neuen Medikamenten ist eine langsame, teure und oft frustrierende Reise. Wissenschaftler müssen winzige Moleküle finden, die an spezifische Ziele im Körper binden können, um eine Krankheit zu stoppen, aber dieselben Moleküle müssen auch die Reise durch den Blutkreislauf überstehen, der Zerstörung durch die Leber entgehen und gesunde Zellen nicht vergiften. Jahrzehntelang haben Forscher versucht, Computern beizubringen, diese Ergebnisse vorherzusagen, indem sie ihnen Bilder von Molekülen zeigten, die meist als Textzeichenfolgen oder Diagramme verbundener Atome dargestellt sind. Ein Molekül existiert jedoch nicht im Vakuum; sein Verhalten hängt vollständig davon ab, wie es mit den komplexen, lebenden Systemen um es herum interagiert. Ein Modell, das nur die Form eines Moleküls sieht, ist wie eine Landkarte, die zwar das Gelände zeigt, aber das Wetter, den Verkehr und die lokalen Gesetze ignoriert. Sie kann einem sagen, wohin eine Straße führt, aber nicht, ob ein Auto tatsächlich darauf fahren kann.

Um dies zu lösen, hat ein Team von Forschern eine neue Art der künstlichen Intelligenz namens Mol-JEPA entwickelt. Anstatt zu versuchen, die Zukunft eines Moleküls vorherzusagen, indem man seine Form leicht verändert – eine Methode, die oft zu Unsinn führt, da winzige Veränderungen in der Chemie enorme Auswirkungen auf das Verhalten haben können –, lernt dieses System, indem es das Molekül aus vielen verschiedenen Blickwinkeln gleichzeitig betrachtet. Stellen Sie sich vor, Sie versuchen, einen Menschen nicht nur durch sein Gesicht zu verstehen, sondern indem Sie auf seine Stimme hören, beobachten, wie er sich bewegt, seine Krankenakte lesen und beobachten, wie er auf verschiedene Lebensmittel reagiert. Mol-JEPA tut genau das für Chemikalien. Es sammelt eine massive Menge an Informationen über fast fünf Millionen Moleküle, einschließlich ihrer atomaren Struktur, wie sie an Proteine binden, wie sie Zellen beeinflussen und ihre physikalischen Eigenschaften. Das System spielt dann ein Vorhersagespiel: Es verbirgt ein Stück dieser Informationen und versucht, basierend auf dem Rest zu erraten, worum es sich handelt. Durch das wiederholte Auffüllen dieser fehlenden Teile lernt der Computer ein tiefes, einheitliches Verständnis dafür, wie Moleküle in der realen Welt funktionieren, anstatt nur ihre statischen Formen auswendig zu lernen.

Die Forscher bauten dieses Modell unter Verwendung einer riesigen Sammlung von Daten aus öffentlichen Datenbanken und neuen Berechnungen auf. Sie kombinierten Standard-Chemikalienmessungen mit fortgeschrittenen Simulationen darüber, wie Atome sich bewegen und interagieren, sowie mit Daten aus Experimenten, die messen, wie Medikamente auf lebende Zellen wirken. Insgesamt erstellten sie einen Datensatz, der fast fünf Millionen einzigartige Verbindungen enthält, von denen jede durch bis zu vierzehn verschiedene Arten von Informationen beschrieben wird. Einige dieser Beschreibungen stammten aus bestehenden Computermodellen, die bereits gelernt hatten, Muster in der Chemie zu erkennen, während andere unter Verwendung von Quantenphysik von Grund auf neu berechnet wurden. Das Team trainierte ihre KI dann so, dass sie als „Weltmodell“ fungiert, ein System, das die Regeln des chemischen Universums versteht. Während des Trainings betrachtete der Computer beispielsweise die Struktur eines Moleküls und dessen zelluläre Wirkungen und wurde dann gefragt, die Bindungsstärke zu einem bestimmten Protein vorherzusagen, oder umgekehrt. Wenn die Vorhersage des Computers falsch war, passte er sein internes Verständnis an, bis es korrekt war. Dieser Prozess ermöglichte es dem Modell, die verborgenen Verbindungen zwischen der Form eines Moleküls und seinem biologischen Verhalten zu lernen, ohne explizit über die Regeln belehrt werden zu müssen.

Als das Team dieses neue Modell gegen andere führende Systeme der künstlichen Intelligenz testete, waren die Ergebnisse beeindruckend. Das Modell schnitt besser als seine Konkurrenten bei einer Vielzahl schwieriger Aufgaben ab, insbesondere wenn die Datenlage gering war. In der realen Welt der Arzneimittelentwicklung müssen Wissenschaftler oft Entscheidungen auf der Grundlage sehr kleiner Mengen an experimentellen Daten treffen, und genau hier glänzte das neue Modell. Es war in der Lage, sein Wissen auf Moleküle zu generalisieren, die es noch nie zuvor gesehen hatte, wobei es selbst bei chemisch sehr unterschiedlichen Testmolekülen im Vergleich zu den während des Trainings untersuchten Molekülen eine hohe Genauigkeit beibehielt. Die Forscher fanden heraus, dass der Erfolg des Modells auf seiner Fähigkeit beruhte, alle verschiedenen Arten von Informationen zu nutzen, die es erhalten hatte. Wenn sie bestimmte Arten von Daten entfernten, wie etwa die detaillierte 3D-Struktur des Moleküls oder dessen zelluläre Wirkungen, zeigten sich beim Modell nur geringfügige Leistungsunterschiede, was darauf hindeutet, dass die gelernten Repräsentationen eine gewisse Redundanz aufweisen, bei der Informationen über mehrere Modalitäten hinweg kodiert sind. Das System hat die Daten nicht einfach nur auswendig gelernt; es hat gelernt, über die Beziehungen zwischen verschiedenen chemischen Eigenschaften zu argumentieren.

Eine der wichtigsten Erkenntnisse war, dass das Modell nicht bei jeder einzelnen Aufgabe perfekt sein muss, um nützlich zu sein. Stattdessen erlernte es eine flexible Repräsentation von Molekülen, die an viele verschiedene Probleme angepasst werden konnte. Die Forscher testeten das Modell bei mehreren anspruchsvollen Benchmarks, einschließlich der Vorhersage, wie gut ein Medikament vom Körper aufgenommen wird oder wie toxisch es sein könnte. In fast allen Fällen übertraf das neue Modell die bisherigen besten Methoden. Es war besonders gut darin, das Problem der „Out-of-Distribution“-Verteilung zu bewältigen, also die Schwierigkeit, vorherzusagen, wie ein neues, ungesehenes Molekül reagiert, wenn es sich chemisch deutlich von allem unterscheidet, was in den Trainingsdaten enthalten war. Durch das Lernen aus einem breiten Spektrum biologischer und physikalischer Kontexte baute das Modell ein robustes Verständnis auf, das es ihm ermöglichte, zuverlässige Vermutungen über neuartige Verbindungen anzustellen. Dies deutet darauf hin, dass die Zukunft der Arzneimittelentwicklung nicht im Bau größerer Modelle liegen könnte, die lediglich mehr Daten auswendig lernen, sondern im Bau smarterer Modelle, die in der Lage sind, vielfältige Informationsquellen zu integrieren, um die komplexe Realität der Wirkweise von Medikamenten zu verstehen.

Die Studie zeigte auch, dass nicht alle Arten von Informationen gleichermaßen wichtig waren, obwohl das System von der Gesamtheit aller Informationen profitierte. Die Forscher fanden heraus, dass die Graph-Modalität, die die Konnektivität und Struktur des Moleküls darstellt, der entscheidende Faktor für die nachgelagerte Leistung war, aber auch chemische Fingerabdrücke und Daten darüber, wie Moleküle mit Zellen interagieren, waren von entscheidender Bedeutung. Interessanterweise war das Modell auch dann in der Lage, effektiv zu lernen, wenn einige der Daten fehlten oder spärlich waren, was ein häufiges Problem in der wissenschaftlichen Forschung darstellt. Diese Resilienz deutet darauf hin, dass der Ansatz auch auf andere Bereiche angewendet werden könnte, in denen Daten unvollständig oder schwer zu beschaffen sind, wie etwa in der Materialwissenschaft oder Biologie. Das Team merkte an, dass das Modell zwar leistungsstark ist, aber keine magische Lösung darstellt; es erfordert immer noch eine sorgfältige Auswahl der Daten, von denen es lernt, und es gibt Grenzen für die Vorhersagefähigkeit bei Molekülen, die völlig anders sind als alles, was es bisher gesehen hat. Der Erfolg dieses Ansatzes markiert jedoch einen bedeutenden Schritt nach vorn bei der Schaffung einer künstlichen Intelligenz, die das chemische Universum wirklich verstehen kann – weg von einfachem Musterabgleich hin zu einem tieferen, kontextuellen Denken, das die Komplexität des Lebens selbst widerspiegelt.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →