← Últimos artículos
📊 statistics

SPINEX_ Symbolic Regression: Similarity-based Symbolic Regression with Explainable Neighbors Exploration

Este artículo presenta SPINEX_SymbolicRegression, un nuevo algoritmo de regresión simbólica basado en la similitud que aprovecha la exploración de vecinos explicable para identificar expresiones de alto mérito, demostrando una precisión y similitud estructural competitivas frente a los métodos líderes en más de 180 funciones de referencia.

Autores originales: MZ Naser, Ahmed Z Naser

Publicado 2026-08-21
📖 5 min de lectura🧠 Análisis profundo

Autores originales: MZ Naser, Ahmed Z Naser

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

En el vasto paisaje de la ciencia moderna, los datos están en todas partes. Los sensores en los puentes, los telescopios en el espacio y los instrumentos en los laboratorios generan flujos interminables de números que describen cómo funciona el mundo. Durante décadas, la forma estándar de dar sentido a estos datos ha sido utilizar modelos de aprendizaje automático que actúan como poderosas cajas negras. Estos sistemas son excelentes para predecir qué sucederá después; pueden pronosticar una tormenta o identificar una enfermedad con alta precisión. Sin embargo, a menudo fallan al explicar por qué hicieron esa predicción. Ofrecen un resultado sin una razón, dejando a los científicos con una respuesta correcta pero sin comprensión del mecanismo subyacente.

Aquí es donde entra en juego un enfoque diferente, conocido como regresión simbólica. A diferencia de los métodos tradicionales que fuerzan los datos a una forma preestablecida, la regresión simbólica actúa más como un explorador curioso. Busca la oración matemática real que describe la relación entre las variables. En lugar de solo adivinar un número, intenta escribir la ecuación misma, descubriendo la fórmula que gobierna los datos. El objetivo no es solo predecir, sino revelar las leyes ocultas de la naturaleza de una manera que un humano pueda leer, comprender y verificar. Esta capacidad de producir modelos transparentes y explicables es crucial para campos como la física y la ingeniería, donde saber el "por qué" es tan importante como saber el "qué".

Basándose en esta necesidad de claridad, un equipo de investigadores ha desarrollado un nuevo algoritmo llamado SPINEX_SymbolicRegression. Esta herramienta está diseñada para encontrar estas oraciones matemáticas de manera más efectiva mediante el uso de un concepto llamado similitud. Imagine que el algoritmo está buscando un tipo específico de árbol en un vasto bosque. En lugar de mirar cada árbol de forma aislada, los compara entre sí. Pregunta: "¿Se parece este nuevo árbol a los que ya están prosperando?". Al enfocarse en expresiones que son estructuralmente similares a candidatos prometedores, el algoritmo puede navegar el espacio de búsqueda de manera más inteligente. No solo busca la respuesta que mejor se ajuste a los números; también busca respuestas que compartan los mismos bloques de construcción, como las mismas variables y operaciones, que los modelos más exitosos que ha encontrado hasta ahora.

Los investigadores probaron este nuevo método contra una colección masiva de 182 problemas matemáticos diferentes. Estos problemas variaban desde ecuaciones simples generadas aleatoriamente hasta fórmulas complejas derivadas de fenómenos físicos del mundo real, como las leyes del movimiento y la termodinámica. Pusieron a competir a su nuevo algoritmo contra PySR, una herramienta líder en el campo, ejecutando miles de simulaciones para ver cuál de los dos encontraba la expresión matemática correcta con más frecuencia. Los resultados mostraron una ventaja distintiva para el nuevo enfoque en áreas específicas. Si bien la herramienta establecida a veces encontraba respuestas que eran ligeramente más precisas en términos de predicción bruta, el nuevo algoritmo era muy superior al encontrar los ingredientes correctos. Era mucho más probable que identificara el conjunto de variables correcto y las operaciones matemáticas necesarias para describir el sistema. En muchos casos, cuando los investigadores requerían que el algoritmo utilizara todas las variables disponibles, el nuevo método lograba una coincidencia perfecta, encontrando la estructura exacta de la ecuación real con mucha más frecuencia que su competidor.

Una característica clave de este trabajo es su enfoque en la explicabilidad. Los investigadores no solo querían una caja negra que funcionara; querían ver cómo el algoritmo evolucionaba sus soluciones. Incluyeron herramientas que permiten a los usuarios ver exactamente cómo el algoritmo evolucionó sus soluciones, qué variables consideró importantes y qué tan similares eran sus mejores conjeturas con las verdaderas leyes subyacentes. En una demostación, se le pidió al algoritmo que encontrara la fórmula para una curva simple. Este evolucionó con éxito una expresión que coincidía estrechamente con el objetivo, y el sistema proporcionó un desglose detallado de por qué ciertas partes de la fórmula funcionaban mejor que otras. Este nivel de transparencia permite a los científicos confiar en el modelo, no solo porque predice bien, sino porque pueden ver la lógica detrás de él.

El estudio concluye que este enfoque basado en la similitud ofrece una nueva y poderosa forma de descubrir relaciones matemáticas. Al equilibrar la necesidad de precisión con la necesidad de similitud estructural, el algoritmo produjo consistentemente modelos que fueron tanto precisos como comprensibles. Los investigadores señalaron que, si bien el método es altamente efectivo, requiere una potencia de cálculo significativa y aún hay margen para mejorar la velocidad con la que puede calcular estas similitudes. Sin embargo, los hallazgos sugieren que, al guiar la búsqueda con el principio de similitud, los científicos pueden generar modelos que no solo sean precisos, sino también alineados con los principios fundamentales del mundo físico. Esto acerca el campo del aprendizaje automático un paso más hacia un futuro donde las computadoras no solo puedan predecir el futuro, sino también explicar las reglas que lo gobiernan.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →