← Últimos artículos
🤖 machine learning

Decomposable Neural Symbolic Regression

Este artículo presenta un método de regresión neurosimbólica descomponible que aprovecha los Transformers de multiconjuntos, los algoritmos genéticos y la programación genética para destilar modelos de regresión opacos en expresiones multivariadas precisas e interpretables que recuperan consistentemente la estructura matemática original manteniendo un rendimiento predictivo competitivo.

Autores originales: Giorgio Morales, John W. Sheppard

Publicado 2026-08-25
📖 4 min de lectura☕ Lectura para el café

Autores originales: Giorgio Morales, John W. Sheppard

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

En el mundo científico moderno, las computadoras se han convertido en herramientas increíblemente poderosas para encontrar patrones en los datos. Pueden observar miles de mediciones del mundo natural y construir modelos complejos que predicen resultados futuros con una alta precisión. Estos modelos suelen denominarse "opacos" porque, si bien funcionan bien, su lógica interna es tan enredada y complicada que los humanos no pueden comprender fácilmente cómo alcanzan sus conclusiones. Son como una caja negra: introduces datos y sale una respuesta, pero el camino intermedio permanece oculto. Para los científicos que estudian física, biología o ingeniería, esta falta de transparencia es un obstáculo importante. Para comprender verdaderamente el universo, los investigadores necesitan más que una simple predicción; necesitan las ecuaciones rectoras, las claras sentencias matemáticas que describen cómo funciona la naturaleza. Este es el objetivo de la regresión simbólica, un campo dedicado a encontrar fórmulas simples y legibles que expliquen los datos observados, en lugar de simplemente memorizarlos.

Un equipo de investigadores de la Universidad Estatal de Montana ha desarrollado una nueva forma de abordar este problema, ofreciendo un método que puede desvelar las capas de estos complejos modelos computacionales para revelar las verdades matemáticas simples que subyacen en ellos. Su enfoque, al que llaman SeTGAP, comienza entrenando un modelo computacional estándar y altamente complejo para aprender el comportamiento de un sistema. Una vez que este modelo "opaco" está entrenado y funcionando, los investigadores no intentan realizar ingeniería inversa de sus millones de ajustes internos. En su lugar, tratan al modelo como una fuente de verdad y le piden que se explique a sí mismo, variable por variable. Aíslan sistemáticamente cada factor de entrada, como la temperatura o la presión, y le preguntan al modelo cómo cambia la salida cuando solo ese único factor se mueve. Al hacer esto, el sistema genera una serie de bocetos simples de una sola variable que describen la forma de la relación para cada pieza del rompecabezas.

Los investigadores utilizan luego un proceso sofisticado para unir estos bocetos individuales. Imagine intentar comprender una máquina compleja primero descubriendo cómo gira cada engranaje por separado y luego viendo cómo se acoplan entre sí. El equipo utiliza una combinación de inteligencia artificial y algoritmos evolutivos para fusionar estos bocetos de una sola variable en una fórmula completa de múltiples variables. No lanzan simplemente todas las piezas a la vez, lo que a menudo conduce a la confusión y a resultados excesivamente complicados. En su lugar, añaden variables una por una, asegurándose de que la estructura de la fórmula permanezca limpia y lógica en cada paso. Este método les permite preservar las relaciones funcionales originales que identificaron al principio, evitando que la ecuación final se convierta en un enredo desordenado de números que se ajusta a los datos pero que no tiene sentido.

Cuando el equipo probó este método contra una amplia variedad de problemas, desde desafíos matemáticos sintéticos hasta ecuaciones de física del mundo real, los resultados fueron sorprendentes. En los problemas sintéticos, su método recuperó con éxito la estructura matemática correcta del sistema subyacente en cada uno de los casos de prueba que realizaron. En contraste, otros métodos líderes, incluidos aquellos que dependen del aprendizaje profundo o de la computación evolutiva tradicional, fallaron frecuentemente al encontrar la forma correcta, produciendo a menudo expresiones que eran demasiado complejas o simplemente erróneas, incluso si predecían los números correctamente. El nuevo enfoque demostró ser particularmente robusto cuando los datos contenían ruido o errores, algo que ocurre con frecuencia en las mediciones del mundo real. Mientras que otros métodos tuvieron dificultades para generalizar más allá de los datos con los que fueron entrenados, las ecuaciones descubiertas por este método se mantuvieron bien cuando fueron probadas en nuevos rangos de valores no vistos.

Los investigadores también aplicaron su técnica a una famosa colección de ecuaciones de física conocida como el conjunto de datos Feynman, que contiene leyes que describen desde la gravedad hasta el comportamiento de la luz. En este referente, su método logró una alta tasa de éxito en la identificación de las ecuaciones correctas, situándose en segundo lugar en la recuperación de soluciones simbólicas con aproximadamente un 61.2% de recuperaciones exitosas, y demostrando un rendimiento predictivo competitivo en relación con muchas técnicas establecidas. El estudio sugiere que, al dividir un problema complejo en partes más pequeñas y manejables y luego reensamblarlas cuidadosamente, es posible sortear las limitaciones de la inteligencia artificial actual. Esto no significa que las computadoras sean menos poderosas; más bien, significa que el método de pedirles que se expliquen a sí mismas es más efectivo. El trabajo demuestra que es posible extraer leyes de la naturaleza claras y legibles para los humanos a partir de las capas profundas y ocultas del aprendizaje automático moderno, convirtiendo las predicciones opacas en una comprensión transparente.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →