← Ultimi articoli
🤖 machine learning

Mol-JEPA: A multimodal Joint Embedding Predictive Architecture for Molecules

Mol-JEPA è un framework multimodale scalabile che apprende modelli del mondo molecolare impiegando il masking delle modalità attraverso diversi dati di drug discovery per superare limitazioni quali le aumentazioni chimicamente non valide e il collasso delle modalità, generando così rappresentazioni robuste attraverso la predizione dello spazio latente.

Autori originali: Florian Rottach, Sebastian Schieferdecker, William Rudman, Randall Balestriero, Carsten Eickhoff

Pubblicato 2026-08-25
📖 6 min di lettura🧠 Approfondimento

Autori originali: Florian Rottach, Sebastian Schieferdecker, William Rudman, Randall Balestriero, Carsten Eickhoff

Articolo originale sotto licenza CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Questa è una spiegazione generata dall'IA dell'articolo qui sotto. Non è stata scritta né approvata dagli autori. Per precisione tecnica, consulta l'articolo originale. Leggi il disclaimer completo

La ricerca di nuovi medicinali è un percorso lento, costoso e spesso frustrante. Gli scienziati devono trovare piccole molecole che possano incastrarsi in bersagli specifici nel corpo per fermare una malattia, ma queste stesse molecole devono anche sopravvivere al viaggio attraverso il flusso sanguigno, evitare di essere distrutte dal fegato e non avvelenare le cellule sane. Per decenni, i ricercatori hanno cercato di insegnare ai computer a prevedere questi esiti mostrandogli immagini di molecole, solitamente rappresentate come stringhe di testo o diagrammi di atomi connessi. Tuttavia, una molecola non esiste nel vuoto; il suo comportamento dipende interamente da come interagisce con i sistemi complessi e viventi che la circondano. Un modello che vede solo la forma di una molecola è come una mappa che mostra il terreno ma ignora il meteo, il traffico e le leggi locali. Può dirti dove va una strada, ma non se un'auto possa effettivamente percorrerla.

Per risolvere questo problema, un team di ricercatori ha sviluppato un nuovo tipo di intelligenza artificiale chiamata Mol-JEPA. Invece di cercare di indovinare il futuro di una molecola alterando leggermente la sua forma — un metodo che spesso porta a risultati privi di senso perché piccoli cambiamenti nella chimica possono causare enormi cambiamenti nel comportamento — questo sistema impara osservando la molecola da molte angolazioni diverse contemporaneamente. Immaginate di cercare di capire una persona non solo dalla sua faccia, ma ascoltando la sua voce, osservando come si muove, leggendo la sua storia clinica e osservando come reagisce a diversi alimenti. Mol-JEPA fa esattamente questo per le sostanze chimiche. Raccoglie una quantità massiccia di informazioni su quasi cinque milioni di molecole, inclusa la loro struttura atomica, il modo in cui si legano alle proteine, come influenzano le cellule e le loro proprietà fisiche. Il sistema poi pratica un gioco di previsione: nasconde un pezzo di questa informazione e cerca di indovinare cos'è basandosi sul resto. Riempendo ripetutamente questi pezzi mancanti, il computer apprende una comprensione profonda e unificata di come le molecole si comportano nel mondo reale, piuttosto che limitarsi a memorizzare le loro forme statiche.

I ricercatori hanno costruito questo modello utilizzando una vasta collezione di dati provenienti da database pubblici e nuovi calcoli. Hanno combinato misurazioni chimiche standard con simulazioni avanzate del movimento e dell'interazione degli atomi, nonché dati provenienti da esperimenti che misurano come i farmaci influenzano le cellule viventi. In totale, hanno creato un dataset contenente quasi cinque milioni di composti unici, ciascuno descritto da fino a quattordici diversi tipi di informazioni. Alcune di queste descrizioni provenivano da modelli informatici esistenti che avevano già imparato a riconoscere schemi in chimica, mentre altre sono state calcolate da zero utilizzando la fisica quantistica. Il team ha quindi addestrato la loro IA per agire come un "modello del mondo", un sistema che comprende le regole dell'universo chimico. Durante l'addestramento, il computer guardava la struttura di una molecola e i suoi effetti cellulari, ad esempio, e poi veniva chiamato a prevedere la sua forza di legame con una specifica proteina, o viceversa. Se il computer sbagliava la previsione, regolava la sua comprensione interna finché non ci riusciva. Questo processo ha permesso al modello di apprendere le connessioni nascoste tra la forma di una molecola e il suo comportamento biologico senza dover essere esplicitamente istruito sulle regole.

Quando il team ha testato questo nuovo modello contro altri sistemi di intelligenza artificiale all'avanguardia, i risultati sono stati sorprendenti. Il modello ha performato meglio dei suoi concorrenti in una vasta gamma di compiti difficili, in particolare quando i dati erano scarsi. Nel mondo reale della scoperta di farmaci, gli scienziati devono spesso prendere decisioni basandosi su quantità molto piccole di dati sperimentali, ed è qui che il nuovo modello ha eccelso. È stato in grado di generalizzare la sua conoscenza su molecole che non aveva mai visto prima, mantenendo un'alta precisione anche quando le molecole di test erano chimicamente molto diverse da quelle studiate durante l'addestramento. I ricercatori hanno scoperto che il successo del modello derivava dalla sua capacità di utilizzare tutti i diversi tipi di informazioni che gli erano stati forniti. Quando rimuovevano certi tipi di dati, come la struttura 3D dettagliata della molecola o i suoi effetti cellulari, le prestazioni del modello mostravano solo differenze minori, suggerendo che le rappresentazioni apprese contengono un grado di ridondanza in cui l'informazione è codificata attraverso molteplici modalità. Il sistema non si è limitato a memorizzare i dati; ha imparato a ragionare sulle relazioni tra le diverse proprietà chimiche.

Uno dei risultati più importanti è stato che il modello non aveva bisogno di essere perfetto in ogni singolo compito per essere utile. Invece, ha appreso una rappresentazione flessibile delle molecole che poteva essere adattata a molti problemi diversi. I ricercatori hanno testato il modello su diversi benchmark impegnativi, incluso il modo in cui un farmaco verrebbe assorbito dal corpo o quanto potrebbe essere tossico. In quasi tutti i casi, il nuovo modello ha superato i metodi migliori precedenti. Era particolarmente bravo a gestire il problema "out-of-distribution", ovvero la difficoltà di prevedere come una nuova molecola non vista si comporterà quando è chimicamente distinta da tutto ciò che è stato presente nei dati di addestramento. Imparando da un ampio spettro di contesti biologici e fisici, il modello ha costruito una comprensione robusta che gli ha permesso di fare ipotesi affidabili su nuovi composti. Ciò suggerisce che il futuro della scoperta di farmaci potrebbe non risiedere nella costruzione di modelli più grandi che si limitano a memorizzare più dati, ma nella costruzione di modelli più intelligenti capaci di integrare diverse fonti di informazione per comprendere la complessa realtà di come funzionano i medicinali.

Lo studio ha anche rivelato che non tutti i tipi di informazione erano ugualmente importanti, sebbene il sistema ne beneficiasse avendo tutti a disposizione. I ricercatori hanno scoperto che la modalità a grafo, che rappresenta la connettività e la struttura della molecola, era l'informazione più critica per le prestazioni a valle, ma che anche le impronte chimiche e i dati sull'interazione delle molecole con le cellule erano vitali. Interessante è che il modello è stato in grado di apprendere efficacemente anche quando alcuni dei dati erano mancanti o scarsi, un problema comune nella ricerca scientifica. Questa resilienza suggerisce che l'approccio potrebbe essere applicato ad altri campi in cui i dati sono incompleti o difficili da ottenere, come la scienza dei materiali o la biologia. Il team ha osservato che, sebbene il modello sia potente, non è una soluzione magica; richiede comunque una selezione attenta dei dati da cui apprende, e ci sono limiti a quanto bene può prevedere gli esiti per molecole completamente diverse da tutto ciò che ha mai visto. Tuttavia, il successo di questo approccio segna un passo avanti significativo nella creazione di un'intelligenza artificiale capace di comprendere veramente il mondo chimico, andando oltre il semplice riconoscimento di schemi verso un ragionamento contestuale più profondo che rispecchia la complessità della vita stessa.

Sommerso dagli articoli nel tuo campo?

Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.

Prova Digest →