← Últimos artículos
🤖 machine learning

Evolving Executable Pipeline Programs for AutoML with Language Models

LACE es un novedoso marco de AutoML que emplea un bucle evolutivo guiado por un modelo de lenguaje de gran tamaño para generar y evolucionar programas de tuberías de Python ejecutables, logrando una precisión competitiva en 68 tareas de OpenML mientras ofrece una transparencia, capacidad de edición y flexibilidad del espacio de búsqueda superiores en comparación con los sistemas tradicionales.

Autores originales: Sofoklis Kitharidis, Cor J. Veenman, Jan N. van Rijn, Thomas Bäck, Niki van Stein

Publicado 2026-08-18
📖 6 min de lectura🧠 Análisis profundo

Autores originales: Sofoklis Kitharidis, Cor J. Veenman, Jan N. van Rijn, Thomas Bäck, Niki van Stein

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

En el mundo de la ciencia de datos moderna, se le pide cada vez más a las máquinas que den sentido a información desordenada del mundo real: predecir si un solicitante de un préstamo podrá pagar, diagnosticar una enfermedad a partir de una hoja de cálculo de síntomas o pronosticar ventas basadas en tendencias pasadas. Para lograr esto, los investigadores construyen "pipelines" (tuberías), que son instrucciones paso a paso que limpian los datos, eligen un modelo matemático y ajustan ese modelo hasta que funciona bien. Durante años, las herramientas más potentes para este trabajo han sido sistemas automatizados que actúan como un maestro chef con un conjunto fijo de ingredientes. Estos sistemas pueden mezclar y combinar pasos de preprocesamiento y algoritmos de aprendizaje conocidos, ajustando las cantidades para encontrar el mejor sabor. Sin embargo, están estrictamente limitados a la despensa que se les dio; no pueden inventar un nuevo ingrediente o una nueva técnica de cocina que quede fuera de su lista predefinida. Esta limitación significa que, si la mejor solución requiere una estructura que el sistema nunca ha visto, esta permanecerá sin descubrir.

Un equipo de investigadores de la Universidad de Leiden ha introducido ahora un enfoque diferente, uno que trata la creación de estos pipelines de datos no como una selección de un menú, sino como la escritura de una nueva receta desde cero. Desarrollaron un sistema llamado LACE, que utiliza un modelo de lenguaje extenso —una inteligencia artificial entrenada en vastas cantidades de texto y código— para actuar como un motor evolutivo. En lugar de elegir de una lista fija de herramientas, LACE le pide a la IA que escriba programas informáticos completos y ejecutables que definan cómo procesar los datos y realizar predicciones. El sistema luego prueba estos programas, aprende de sus errores y le pide a la IA que escriba versiones mejoradas, repitiendo este ciclo hasta encontrar una solución altamente efectiva. El resultado es un sistema que no solo retoca herramientas existentes, sino que puede componer estructuras enteramente nuevas, produciendo código que los expertos humanos pueden leer, entender y modificar directamente.

Los investigadores probaron este método en 68 tareas diferentes de clasificación de datos, que van desde conjuntos de datos pequeños con unos pocos cientos de entradas hasta colecciones masivas con casi cinco millones de filas. Compararon LACE contra varios sistemas automatizados establecidos y un conjunto de modelos preentrenados fijos. Los resultados mostraron que LACE, cuando es impulsado por un modelo de lenguaje específico, funcionó tan bien como los sistemas automatizados más fuertes existentes y significativamente mejor que los métodos más antiguos. Crucialmente, aunque algunos de los modelos preentrenados más nuevos fueron ligeramente más precisos en las tareas específicas que podían manejar, fallaron al intentar trabajar en muchos de los conjuntos de datos más grandes o complejos del conjunto de pruebas. LACE, por el contrario, generó con éxito una solución funcional para cada una de las tareas que se le presentaron.

Lo que hace que este logro sea particularmente notable es la naturaleza del resultado. Los sistemas automatizados tradicionales suelen devolver una "caja negra": un objeto complejo y ajustado que funciona bien pero es difícil de inspeccionar o cambiar para un humano sin un profundo conocimiento técnico del marco de software. LACE devuelve código Python ordinario. Esto significa que un científico de datos puede mirar el programa final, ver exactamente cómo se limpiaron los datos, qué modelos se eligieron y cómo se combinaron, y luego editar el código para mejorarlo aún más o adaptarlo para un nuevo propósito. Los investigadores encontraron que la IA no solo copió patrones existentes; evolucionó soluciones diversas, combinando a menudo diferentes tipos de modelos de maneras novedosas y escribiendo lógica personalizada para mezclar sus predicciones. En muchos casos, la IA escribió su propio código para mezclar las salidas de múltiples modelos, un nivel de flexibilidad que los sistemas fijos no pueden replicar fácilmente.

El estudio también abordó una preocupación común en la investigación de la inteligencia artificial: que la IA simplemente estuviera memorizando las respuestas a las preguntas de la prueba porque las había visto antes durante su entrenamiento. Para evitar esto, los investigadores ocultaron los nombres y los detalles específicos de los conjuntos de datos, dándole a la IA solo una descripción general del tamaño y tipo de los datos. A pesar de esta falta de conocimiento específico, el sistema aun así encontró soluciones de alto rendimiento, lo que sugiere que estaba aprendiendo genuinamente cómo construir pipelines efectivos en lugar de recordar respuestas. Los investigadores verificaron además que la IA siguiera reglas estrictas, como no utilizar búsquedas internas ocultas para ajustar sus propios parámetros, asegurando que las mejoras provinieran del proceso de búsqueda evolutiva en sí mismo.

Uno de los hallazgos más impactantes fue la rapidez con la que el sistema mejoró. El primer programa generado por la IA era a menudo defectuoso o incompleto, pero a medida que el sistema iteraba, aprendía a corregir estos errores y a refinar la lógica. Para cuando el proceso terminó, los programas finales no solo eran válidos, sino significativamente más precisos que los intentos iniciales. Los investigadores observaron que el sistema tendía a favorecer ciertos tipos de modelos, como los ensambles basados en árboles, pero no se quedó estancado en un solo patrón; exploró una amplia variedad de combinaciones estructurales. Esta diversidad sugiere que el sistema es capaz de descubrir soluciones que un humano podría no pensar en intentar, o que un sistema rígido nunca consideraría.

El trabajo demuestra que tratar el aprendizaje automático automatizado como un proceso de escritura y evolución de código abre una nueva frontera. Va más allá de la restricción de una biblioteca fija de herramientas, permitiendo que el sistema adapte su estructura al problema específico en cuestión. Aunque el costo computacional de ejecutar estos experimentos fue alto, requiriendo un tiempo significativo para generar y probar miles de programas candidatos, los resultados sugieren que la capacidad de producir código transparente, editable y altamente efectivo es un intercambio valioso. Los investigadores concluyen que este enfoque ofrece un camino prometedor, donde la búsqueda del mejor pipeline de datos está definida por la creatividad del propio código, en lugar de por las limitaciones de un conjunto preseleccionado de componentes.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →