← Últimos artículos
🤖 AI

LLM-Based Scientific Equation Discovery via Physics-Informed Token-Regularized Policy Optimization

Este artículo presenta PiT-PO, un marco de aprendizaje por refuerzo que transforma los Grandes Modelos de Lenguaje en generadores adaptativos para la regresión simbólica mediante la imposición de validez física jerárquica y parsimonia estructural a nivel de token, logrando así el estado del arte en el descubrimiento de ecuaciones y permitiendo que modelos de pequeña escala superen a gigantes de código cerrado.

Autores originales: Boxiao Wang, Kai Li, Tianyi Liu, Chen Li, Junzhe Wang, Yifan Zhang, Jian Cheng

Publicado 2026-08-12
📖 4 min de lectura☕ Lectura para el café

Autores originales: Boxiao Wang, Kai Li, Tianyi Liu, Chen Li, Junzhe Wang, Yifan Zhang, Jian Cheng

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina que eres un detective intentando resolver un misterio, pero en lugar de buscar huellas dactilares o pisadas, estás cazando la receta matemática secreta que gobierna cómo funciona el mundo. Este campo se llama Regresión Simbólica. Mientras que la mayoría de los programas informáticos actuales son como cajas negras que adivinan una respuesta sin explicar el porqué, la Regresión Simbólica intenta encontrar la ecuación real —la "ley de la naturaleza"— oculta dentro de un montón de datos. Piensa en ello como si estuvieras escuchando una canción e intentaras escribir la partitura desde cero, en lugar de simplemente tararear la melodía.

Durante mucho tiempo, los científicos utilizaron métodos de la vieja escuela para encontrar estas recetas, pero eran lentos y a menudo se perdían en el vasto desierto de posibles fórmulas matemáticas. Recientemente, un nuevo tipo de "supercerebro" llamado Modelo de Lenguaje Extenso (LLM) ha entrado en el juego. Estos son el mismo tipo de IA que pueden escribir historias o charlar contigo, pero también han leído millones de libros de texto científicos. Debido a esto, son increíblemente buenos adivinando cómo podría verse una ecuación científica. Sin embargo, hay un inconveniente: estos modelos de IA suelen ser como un estudiante que memorizó el libro de texto pero nunca tomó un examen. Pueden escupir una fórmula que parece correcta y que se ajusta perfectamente a los números, pero que podría romper las leyes de la física o ser innecesariamente complicada, como una receta que pide una taza de sal solo porque al chef le dio la gana.

Aquí es donde entra en juego un nuevo estudio. Los investigadores, liderados por Boxiao Wang y Kai Li, querían solucionar este problema del "memorizador". Crearon un sistema llamado PiT-PO (Optimización de Política Regularizada por Tokens con Información de Física). En lugar de solo pedirle a la IA una suposición y esperar lo mejor, PiT-PO convierte a la IA en un estudiante que realmente aprende de sus errores en tiempo real. Es como tener a un profesor de física estricto pero brillante parado justo al lado de la IA, susurrando: "No, ese término no tiene sentido físico", o "¡Estás usando demasiados ingredientes; simplifícalo!".

El equipo construyó un ciclo de retroalimentación inteligente. Cuando la IA genera una ecuación candidata, PiT-PO la comprueba contra dos reglas estrictas. Primero, comprueba la Validez Física: ¿Obedece esta ecuación las leyes de la física? Por ejemplo, si la ecuación predice que un fluido fluye cuesta arriba sin ninguna energía, el sistema le impone una penalización. Segundo, comprueba la Redundancia: ¿Está la ecuación inflada con partes innecesarias? Los investigadores utilizaron un truco matemático llamado "Teorema de Exclusión de Soporte" para detectar términos que son solo ruido y castigar a la IA por incluirlos.

Los resultados son impresionantes. En sus pruebas, PiT-PO no solo encontró ecuaciones que se ajustaban a los datos; encontró las leyes subyacentes correctas, incluso cuando los datos eran desordenados. En una prueba específica que involucraba el flujo caótico de aire sobre colinas (un problema conocido como "Flujo sobre Colinas Periódicas"), la IA descubrió una nueva forma de modelar la turbulencia que estaba mucho más cerca de la realidad que los métodos tradicionales. Quizás lo más emocionante sea que este sistema funcionó tan bien que incluso un modelo de IA de código abierto y pequeño (uno que puede ejecutarse en una computadora estándar) fue capaz de superar a gigantes masivos y costosos de "código cerrado".

Al enseñar a la IA a aprender de su propio proceso de búsqueda y al imponer estrictamente las reglas de la física, PiT-PO convierte a una máquina de adivinación estática en un descubridor científico adaptativo. Esto sugiere que no necesitamos esperar a que las supercomputadoras desbloqueen los secretos del universo; con el entrenamiento adecuado, las herramientas de IA más pequeñas y accesibles pueden ayudarnos a descubrir las ecuaciones fundamentales que impulsan desde la dinámica de fluidos hasta el crecimiento biológico.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →