← Últimos artículos
🤖 machine learning

Searching the Space of Feed-Forward Neural-Network Weight-Update Rules with Fixed Depth Symbolic Regression

Este artículo demuestra que la regresión simbólica de profundidad fija puede descubrir eficazmente reglas de actualización de pesos de redes neuronales compactas y de alto rendimiento que superan significativamente a los optimizadores estándar diseñados a mano en evaluaciones a pequeña escala, lo que sugiere un enfoque ligero y prometedor para el descubrimiento automatizado de optimizadores.

Autores originales: Charles Brum, Edward Finkelstein

Publicado 2026-07-27
📖 3 min de lectura☕ Lectura para el café

Autores originales: Charles Brum, Edward Finkelstein

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina que estás intentando enseñarle a un robot a pintar un cuadro, pero el robot es torpe y no deja de manchar el lienzo. Para solucionar esto, necesitas un conjunto de instrucciones —una receta— que le diga exactamente cómo ajustar sus pinceladas para acercarse a la obra maestra. En el mundo de la inteligencia artificial, estas instrucciones se llaman "reglas de actualización de pesos". Son los pasos matemáticos que una computadora realiza para aprender de sus errores. Durante décadas, los científicos han elaborado estas recetas a mano, mezclando ingredientes como el "momentum" (para mantener al robot moviéndose en una buena dirección) o "tasas adaptativas" (para frenar cuando las cosas se ponen complicadas). Pero aquí surge la gran pregunta: ¿Nos falta una mejor receta? ¿Y si existe una forma secreta y supereficiciente de enseñarle al robot que ningún humano ha pensado en escribir todavía? Este es el patio de recreo de la "regresión simbólica", una técnica que actúa como un alquimista digital, buscando entre infinitas combinaciones de símbolos matemáticos para encontrar la fórmula perfecta para aprender.

En este artículo, dos investigadores decidieron dejar que una computadora se encargara de la cocina. En lugar de adivinar qué ingredientes crean el mejor optimizador, utilizaron un método llamado regresión simbólica para cazar nuevas reglas de actualización de pesos. Piensa en ello como un algoritmo genético que cría millones de expresiones matemáticas diferentes, probando cada una para ver si ayuda a una pequeña red neuronal a aprender una tarea de forma más rápida y precisa que las mejores reglas diseñadas por humanos. No se limitaron a retocar las recetas existentes; dejaron que la computadora inventara otras completamente nuevas utilizando una caja de herramientas de operaciones matemáticas comunes (como sumar, multiplicar o extraer raíces cuadradas) e ingredientes estándar como los gradientes y el momentum.

Los resultados fueron sorprendentemente sabrosos. De 30 desafíos de aprendizaje diferentes, las reglas descubiertas por la computadora superaron a los mejores optimizadores ajustados por humanos en 25 casos. Cuando la computadora encontraba un ganador, reducía un promedio del 44,47% del error (medido como Error Cuadrático Medio) en comparación con los métodos estándar. Sin embargo, el artículo es cuidadoso al señalar que estos experimentos se realizaron en redes pequeñas y simples, y solo durante 10 épocas (una sola ronda de entrenamiento). Los autores sugieren que, si bien estas nuevas reglas son compactas y efectivas para estas tareas específicas, aún no sabemos si se mantendrán firmes en el mundo desordenado y complejo del aprendizaje profundo masivo.

Las reglas descubiertas no se veían todas iguales. Algunas eran simples, mientras que otras eran mezclas salvajes de funciones trigonométricas, exponenciales y expresiones racionales. Sin embargo, muchas compartían un espíritu común: combinaban el momentum (como una bola rodante que gana velocidad) con la normalización adaptativa (ajustando el tamaño del paso basándose en el rendimiento pasado). Los investigadores descubrieron que la computadora podía tropezar con estas fórmulas efectas e interpretables sin que se le dijera explícitamente cómo hacerlo. Esto sugiere que el espacio de "cómo aprender" es vasto y está lleno de gemas ocultas que la intuición humana podría pasar por alto. Pero antes de que tiremos nuestros viejos libros de cocina, los autores advierten que estos hallazgos son un comienzo prometedor, no una victoria final. Las reglas deben probarse en redes más grandes y sesiones de entrenamiento más largas para ver si son realmente el futuro del aprendizaje de la IA o simplemente un truco ingenioso para acertijos pequeños.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →