← Últimos artículos
🧬 biology

Monroe: A Molecular Foundation Model for In-Context Probabilistic Inference

Este artículo presenta Monroe, un modelo fundacional molecular escalable entrenado con 81 millones de moléculas con representaciones estereoquímicas mejoradas y objetivos de entrenamiento novedosos, el cual logra un rendimiento de vanguardia en la predicción de actividad de bioensayos al aprovechar un modelo ajustado a datos previos (TabPFN) para la inferencia probabilística en contexto y demostrar que esta estrategia de adaptación descendente también mejora significativamente modelos existentes como MiniMol y CheMeleon.

Autores originales: Blazej Banaszewski, Andrew W. Fitzgibbon

Publicado 2026-08-20
📖 5 min de lectura🧠 Análisis profundo

Autores originales: Blazej Banaszewski, Andrew W. Fitzgibbon

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). ⚕️ Esta es una explicación generada por IA de un preprint que no ha sido revisado por pares. No es consejo médico. No tome decisiones de salud basándose en este contenido. Leer descargo de responsabilidad completo

En la carrera por descubrir nuevos medicamentos, los científicos se enfrentan a un obstáculo persistente: la forma más fiable de saber si una molécula curará una enfermedad es construirla y probarla en un laboratorio. Este proceso es lento, costoso y está limitado por el número de instalaciones especializadas que pueden realizar estos experimentos. Debido a esto, los datos disponibles para entrenar programas informáticos suelen ser escasos. Para superar esto, los investigadores han recurrido a una estrategia similar a cómo un niño aprende a reconocer animales antes de haber visto jamás un perro o un gato específico. Entrenan modelos informáticos masivos con vastas bibliotecas de estructuras químicas y sus propiedades físicas básicas, enseñando al software un sentido general de cómo se comportan las moléculas. Una vez construido este fundamento, el modelo puede adaptarse para predecir resultados biológicos específicos, como si un compuesto se unirá a un virus, incluso cuando solo se dispone de un puñado de resultados experimentales para esa tarea específica. Este enfoque, conocido como un modelo fundacional molecular, pretende cerrar la brecha entre el mundo infinito de las posibles sustancias químicas y los limitados datos de las pruebas de fármacos del mundo real.

Un equipo de investigadores ha presentado un nuevo modelo llamado Monroe, que representa un paso significativo hacia adelante en este campo. El nombre rinde homenaje a Elizabeth Monroe Boggs, una pionera en la química computacional, pero el modelo en sí es un sistema de aprendizaje automático moderno diseñado para comprender el complejo lenguaje de las moléculas. Los investigadores entrenaron a Monroe con un conjunto de datos masivo que contiene más de 81 millones de moléculas, una escala mucho mayor que los intentos anteriores. Este conjunto de datos incluyó cálculos detallados de química cuántica, que describen la energía y la estructura de los átomos, así como datos de miles de ensayos biológicos que miden cómo las moléculas interactúan con los sistemas vivos. Al exponer el modelo a esta inmensa variedad de información, los investigadores le permitieron aprender reglas generales de la química que se aplican a diferentes tipos de problemas, en lugar de simplemente memorizar ejemplos específicos.

Una de las innovaciones más críticas de Monroe es cómo gestiona la forma tridimensional de las moléculas, específicamente su "lateralidad". Muchas moléculas existen en dos formas que son imágenes especulares entre sí, de forma muy parecida a una mano izquierda y una derecha. Aunque estas imágenes especulares tienen los mismos átomos conectados en el mismo orden, a menudo se comportan de forma completamente diferente en el cuerpo humano; una podría ser un medicamento, mientras que su imagen especular podría ser tóxica. Los modelos informáticos estándar suelen tener dificultades para distinguir estas versiones porque dependen de descripciones matemáticas que parecen idénticas para ambas formas. Monroe resuelve esto añadiendo explícitamente conexiones adicionales en su mapa interno de la molécula que actúan como banderas para estas diferencias de imagen especular. Esto permite al modelo distinguir entre las dos formas con alta precisión, una capacidad que es esencial para predecir cómo funcionará realmente un fármaco en un sistema biológico.

Los investigadores también refinaron la forma en que el modelo aprende de sus datos de entrenamiento. En lugar de tratar cada tarea de aprendizaje como igualmente importante, Monroe utiliza un sistema de ponderación inteligente que ajusta automáticamente su enfoque. Presta más atención a las tareas donde los datos son claros y fiables, y menos atención a las tareas que son ruidosas o inciertas. Además, el modelo está entrenado para limpiar los datos imperfectos. En el mundo real, las formas 3D de las moléculas utilizadas en las simulaciones por computadora suelen ser aproximaciones toscas. Monroe es enseñado a tomar estas formas toscas y refinarlas en formas más precisas y estables, un proceso que ayuda al modelo a comprender las reglas físicas subyacentes que gobiernan la estabilidad molecular. Esta capacidad de "eliminar el ruido" de los datos fortalece sus predicciones para aplicaciones del mundo real.

Al ser probado contra otros modelos líderes, Monroe demostró un rendimiento superior, particularmente en los escenarios más desafiantes conocidos como "acantilados de actividad". Estos son casos en los que dos moléculas son casi idénticas en estructura pero tienen efectos biológicos drásticamente diferentes. Predecir estas diferencias bruscas es notoriamente difícil para la inteligencia artificial, y aun así Monroe superó a sus competidores en estas pruebas. Los investigadores también descubrieron que su método para adaptar el modelo a nuevas tareas era altamente efectivo. En lugar de reentrenar todo el modelo para cada nuevo objetivo farmacológico, utilizaron una técnica que permite al modelo aprender de un pequeño conjunto de ejemplos en un solo paso, de forma similar a cómo un humano puede aprender una nueva regla tras ver solo unos pocos ejemplos. Este enfoque, que aplicaron no solo a Monroe sino también para mejorar otros dos modelos existentes, demostró ser una estrategia poderosa y general.

El estudio concluye que la combinación de un preentrenamiento a gran escala con mejoras arquitectónicas específicas, como un mejor manejo de la lateralidad molecular y una ponderación inteligente de los datos, crea una herramienta más robusta para el descubrimiento de fármacos. Si bien el modelo no resuelve todos los problemas de la predicción molecular, y el desafío de los acantilados de actividad sigue siendo difícil, Monroe establece un nuevo estándar para lo que es posible. Demuestra que, al enseñar a las computadoras una comprensión más profunda y matizada de la estructura y el comportamiento químico, los científicos pueden construir herramientas que estén mejor equipadas para navegar por el vasto y complejo paisaje de los medicamentos potenciales, acelerando potencialmente el viaje desde una idea química hasta un tratamiento que salve vidas.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →