← Últimos artículos
🤖 machine learning

Mol-JEPA: A multimodal Joint Embedding Predictive Architecture for Molecules

Mol-JEPA es un marco multimodal escalable que aprende modelos de mundo molecular mediante el empleo de enmascaramiento de modalidades a través de diversos datos de descubrimiento de fármacos para superar limitaciones como las aumentaciones químicamente inválidas y el colapso de modalidad, generando así representaciones robustas mediante la predicción del espacio latente.

Autores originales: Florian Rottach, Sebastian Schieferdecker, William Rudman, Randall Balestriero, Carsten Eickhoff

Publicado 2026-08-25
📖 6 min de lectura🧠 Análisis profundo

Autores originales: Florian Rottach, Sebastian Schieferdecker, William Rudman, Randall Balestriero, Carsten Eickhoff

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

La búsqueda de nuevos medicamentos es un viaje lento, costoso y, a menudo, frustrante. Los científicos deben encontrar moléculas diminutas que puedan encajarse en dianas específicas del cuerpo para detener una enfermedad, pero estas mismas moléculas también deben sobrevivir al viaje a través del torrente sanguíneo, evitar ser destruidas por el hígado y no envenenar las células sanas. Durante décadas, los investigadores han intentado enseñar a las computadoras a predecir estos resultados mostrándoles imágenes de moléculas, representadas usualmente como cadenas de texto o diagramas de átomos conectados. Sin embargo, una molécula no existe en el vacío; su comportamiento depende enteramente de cómo interactúa con los sistemas complejos y vivos que la rodean. Un modelo que solo ve la forma de una molécula es como un mapa que muestra el terreno pero ignora el clima, el tráfico y las leyes locales. Puede decirle dónde va un camino, pero no si un coche puede realmente circular por él.

Para resolver esto, un equipo de investigadores ha desarrollado un nuevo tipo de inteligencia artificial llamada Mol-JEPA. En lugar de intentar adivinar el futuro de una molécula alterando ligeramente su forma —un método que a menudo conduce al sinsentido porque pequeños cambios en la química pueden causar enormes cambios en el comportamiento—, este sistema aprende observando la molécula desde muchos ángulos diferentes a la vez. Imagine intentar comprender a una persona no solo por su rostro, sino escuchando su voz, observando cómo se mueve, leyendo su historial médico y observando cómo reacciona ante diferentes alimentos. Mol-JEPA hace exactamente esto para los productos químicos. Recopila una cantidad masiva de información sobre casi cinco millones de moléculas, incluyendo su estructura atómica, cómo se unen a las proteínas, cómo afectan a las células y sus propiedades físicas. El sistema luego practica un juego de predicción: oculta una pieza de esta información e intenta adivinar qué es basándose en el resto. Al completar repetidamente estas piezas faltantes, la computadora aprende una comprensión profunda y unificada de cómo se comportan las moléculas en el mundo real, en lugar de simplemente memorizar sus formas estáticas.

Los investigadores construyeron este modelo utilizando una vasta colección de datos de bases de datos públicas y nuevos cálculos. Combinaron mediciones químicas estándar con simulaciones avanzadas de cómo se mueven e interactúan los átomos, así como datos de experimentos que miden cómo los fármacos afectan a las células vivas. En total, crearon un conjunto de datos que contiene casi cinco millones de compuestos únicos, cada uno descrito por hasta catorce tipos diferentes de información. Algunas de estas descripciones provenían de modelos computacionales existentes que ya habían aprendido a reconocer patrones en la química, mientras que otras fueron calculadas desde cero utilizando física cuántica. El equipo entrenó a su IA para actuar como un "modelo de mundo", un sistema que comprende las reglas del universo químico. Durante el entrenamiento, la computadora observaba la estructura de una molécula y sus efectos celulares, por ejemplo, y luego se le pedía que predijera su fuerza de unión a una proteína específica, o viceversa. Si la computadora erraba la predicción, ajustaba su comprensión interna hasta lograr acertar. Este proceso permitió al modelo aprender las conexiones ocultas entre la forma de una molécula y su comportamiento biológico sin necesidad de que se le dictaran explícitamente las reglas.

Cuando el equipo probó este nuevo modelo contra otros sistemas de inteligencia artificial líderes, los resultados fueron sorprendentes. El modelo funcionó mejor que sus competidores en una amplia gama de tareas difíciles, particularmente cuando los datos eran escasos. En el mundo real del descubrimiento de fármacos, los científicos a menudo tienen que tomar decisiones basadas en cantidades muy pequeñas de datos experimentales, y es aquí donde el nuevo modelo destacó. Fue capaz de generalizar su conocimiento a moléculas que nunca había visto, manteniendo una alta precisión incluso cuando las moléculas de prueba eran químicamente muy diferentes de las que había estudiado durante el entrenamiento. Los investigadores encontraron que el éxito del modelo se debió a su capacidad para utilizar todos los diferentes tipos de información que se le habían suministrado. Cuando eliminaron ciertos tipos de datos, como la estructura 3D detallada de la molécula o sus efectos celulares, el rendimiento del modelo mostró solo diferencias menores, lo que sugiere que las representaciones aprendidas contienen un grado de redundancia donde la información se codifica a través de múltiples modalidades. El sistema no solo memorizó los datos; aprendió a razonar sobre las relaciones entre diferentes propiedades químicas.

Uno de los hallazgos más importantes fue que el modelo no necesitaba ser perfecto en cada tarea individual para ser útil. En cambio, aprendió una representación flexible de las moléculas que podía adaptarse a muchos problemas diferentes. Los investigadores probaron el modelo en varios bancos de pruebas desafiantes, incluyendo la predicción de qué tan bien sería absorbido un fármaco por el cuerpo o qué tan tóxico podría ser. En casi todos los casos, el nuevo modelo superó a los mejores métodos anteriores. Fue especialmente bueno manejando el problema de "fuera de la distribución" (out-of-distribution), que es la dificultad de predecir cómo se comportará una nueva molécula no vista cuando es químicamente distinta a cualquier cosa en los datos de entrenamiento. Al aprender de un amplio espectro de contextos biológicos y físicos, el modelo construyó un entendimiento robusto que le permitió hacer conjeturas fiables sobre compuestos novedosos. Esto sugiere que el futuro del descubrimiento de fármacos puede no residir en construir modelos más grandes que solo memoricen más datos, sino en construir modelos más inteligentes que puedan integrar diversas fuentes de información para comprender la compleja realidad de cómo funcionan las medicinas.

El estudio también reveló que no todos los tipos de información eran igualmente importantes, aunque el sistema se beneficiaba de tenerlos todos. Los investigadores encontraron que la modalidad de grafo, que representa la conectividad y estructura de la molécula, era la pieza de información más crítica para el rendimiento posterior, pero que las huellas químicas y los datos sobre cómo las moléculas interactúan con las células también eran vitales. Curiosamente, el modelo pudo aprender eficazmente incluso cuando algunos de los datos eran inexistentes o escasos, un problema común en la investigación científica. Esta resiliencia sugiere que el enfoque podría aplicarse a otros campos donde los datos son incompletos o difíciles de obtener, como la ciencia de materiales o la biología. El equipo señaló que, si bien el modelo es poderoso, no es una solución mágica; todavía requiere una selección cuidadosa de los datos de los que aprende, y existen límites en cuanto a qué tan bien puede predecir resultados para moléculas que son completamente distintas a cualquier cosa que haya visto antes. Sin embargo, el éxito de este enfoque marca un paso significativo hacia la creación de una inteligencia artificial que pueda verdaderamente comprender el mundo químico, pasando del simple reconocimiento de patrones a un razonamiento contextual más profundo que refleja la complejidad de la vida misma.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →