← Últimos artículos
💻 computer science

Mutual Lateral Prediction for Locally Trained Spiking Neural Networks

Este artículo presenta MPC-SNN, una novedosa red neuronal de impulsos convolucional que logra una precisión de vanguardia en el benchmark DVS128 Gesture mediante un aprendizaje estrictamente local y libre de retropropagación, al permitir que las neuronas predigan las entradas de alimentación hacia adelante de sus pares a través de una matriz de pesos laterales aprendida.

Autores originales: Nitesh Kamanuru Purushotham, Pranav Kulkarni

Publicado 2026-08-19
📖 5 min de lectura🧠 Análisis profundo

Autores originales: Nitesh Kamanuru Purushotham, Pranav Kulkarni

Artículo original bajo licencia CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

En la búsqueda de construir máquinas que vean y piensen con la eficiencia del cerebro humano, los investigadores han observado durante mucho tiempo un tipo especial de red artificial llamada red neuronal de impulsos (spiking neural network). A diferencia de los programas informáticos estándar que procesan la información en un flujo constante y continuo, estas redes imitan el propio lenguaje eléctrico del cerebro: ráfagas breves y agudas de actividad conocidas como impulsos o "spikes". Este enfoque es particularmente adecuado para nuevos tipos de hardware diseñados para imitar la biología, que pueden realizar tareas complejas utilizando una fracción mínima de la energía requerida por las computadoras convencionales. Sin embargo, un gran obstáculo ha persistido. La forma más precisa de enseñar a estas redes a reconocer patrones depende actualmente de un método que requiere que la computadora envíe señales de error hacia atrás a través de cada capa de la red, un proceso que es imposible de ejecutar en el hardware de bajo consumo energético y que no tiene un equivalente en el cerebro biológico. Los científicos han estado buscando una manera de entrenar estas redes utilizando únicamente reglas locales, donde cada parte de la red aprende de sus vecinos inmediatos sin necesidad de una señal global desde la parte superior.

Un equipo de investigadores ha introducido ahora un nuevo sistema que resuelve este problema enseñando a la red a predecir lo que sus vecinos están a punto de experimentar. En esta nueva arquitectura, llamada MPC-SNN, cada neurona no solo reacciona a las señales que recibe, sino que también intenta adivinar las señales que sus pares en la misma capa recibirán. Si la predicción es correcta, la neurona permanece en silencio. Si la predicción es errónea, la neurona emite un impulso para señalar la sorpresa. Este mecanismo permite que la red aprenda enteramente de interacciones locales, utilizando una regla específica en la que una neurona actualiza sus conexiones basándose en su propio error y en la actividad reciente de un vecino. Los investigadores probaron este sistema en un conjunto de datos de gestos de la mano registrados por una cámara especial que solo ve cambios en la luz, una tarea que coincide perfectamente con las fortalezas de este tipo de tecnología.

Los resultados del estudio muestran que este enfoque funciona notablemente bien. En el conjunto de prueba de 288 muestras de gestos, la red alcanzó una precisión del 95,83 por ciento, un rendimiento que iguala a los mejores métodos existentes que no utilizan señales de error globales y supera significativamente a los sistemas que ya se han implementado en chips neuromórficos físicos. Quizás más importante aún, la red se volvió mucho más eficiente a medida que aprendía. Durante el proceso de entrenamiento, el número de impulsos que emitió disminuyó en más de un 60 por ciento, lo que significa que el sistema final utiliza mucha menos energía para tomar una decisión. Esta eficiencia no fue forzada por una regla específica de dispersión; más bien, surgió naturalmente porque la red aprendió a disparar solo cuando estaba verdaderamente sorprendida por la entrada.

Un descubrimiento clave en el estudio fue que el mecanismo que permitía a las neuronas predecir las entradas de sus vecinos no era solo una idea teórica, sino una parte activa y creciente del sistema. Cuando los investigadores comenzaron el entrenamiento, las conexiones responsables de estas predicciones eran casi nulas. A medida que la red aprendía, estas conexiones crecieron significamente, con la capa más fuerte aumentando su poder predictivo en más de veinte veces. Este crecimiento ocurrió sin etiquetas ni guía externa, demostrando que la red estaba genuinamente aprendiendo a anticipar la actividad de sus pares. El estudio también encontró que el sistema era altamente eficiente con la información que se le proporcionaba. Incluso cuando los investigadores redujeron la cantidad de datos etiquetados utilizados para el entrenamiento a solo una cuarta parte de la cantidad original, la red mantuvo casi tres cuartas partes de su precisión, lo que sugiere que la fase inicial de aprendizaje local ya había construido una comprensión robusta del mundo visual.

Si bien el sistema funcionó excepcionalmente bien en simulación, los investigadores fueron cuidadosos al señalar que los resultados están actualmente limitados a modelos informáticos y aún no han sido probados en chips neuromórficos físicos. También observaron que el sistema tuvo dificultades para identificar gestos que eran estructuralmente muy diferentes de los datos de entrenamiento, lo que indica que su capacidad para detectar entradas inusuales es todavía limitada. No obstante, este trabajo proporciona una demostración concreta de que una red puede aprender tareas complejas utilizando únicamente reglas locales y codificación predictiva, ofreciendo un camino viable hacia la construcción de máquinas inteligentes que operen con la baja energía y la alta velocidad de los sistemas biológicos. El éxito de este enfoque sugiere que el futuro de la inteligencia artificial eficiente podría no residir en enviar cantidades masivas de datos hacia atrás a través de una red, sino en enseñar a cada parte del sistema a escuchar y predecir a sus vecinos.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →