← Últimos artículos
🤖 machine learning

KAN-Robust-Bench: A Benchmark for Evaluating the Robustness of Kolmogorov-Arnold Networks

Este artículo presenta KAN-Robust-Bench, un referente que evalúa la robustez certificada y empírica de las Redes de Kolmogorov-Arnold frente a ataques de evasión fuertes para identificar estrategias de defensa y arquitecturas óptimas.

Autores originales: Mohammad Meymani, Roozbeh Razavi-Far

Publicado 2026-08-25
📖 6 min de lectura🧠 Análisis profundo

Autores originales: Mohammad Meymani, Roozbeh Razavi-Far

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

En el mundo moderno, la inteligencia artificial se ha convertido en un socio silencioso de la vida cotidiana, clasificando nuestros correos electrónicos, guiando nuestros coches y diagnosticando enfermedades. Estos sistemas aprenden encontrando patrones en grandes cantidades de datos, de forma muy similar a como un niño aprende a reconocer un gato al ver muchas fotos de gatos. Sin embargo, este proceso de aprendizaje tiene una debilidad oculta. Así como un humano puede ser engañado por una ilusión ingeniosa, estos modelos informáticos pueden ser confundidos por cambios diminutos, casi invisibles, en las imágenes que ven. Un investigador podría añadir unas pocas motas de ruido digital a la imagen de una señal de alto —cambios tan pequeños que el ojo humano nunca los notaría— y el ordenador podría verla repentinamente como una señal de límite de velocidad. Esta vulnerabilidad se conoce como "ataque de evasión" y representa un serio riesgo de seguridad para cualquier sistema que dependa de la inteligencia artificial para tomar decisiones seguras.

Para entender cómo proteger estos sistemas, los científicos prueban constantemente nuevos tipos de cerebros informáticos. Durante décadas, el diseño estándar ha sido un tipo específico de red que procesa la información en capas. Recientemente, un diseño diferente llamado Red Kolmogorov-Arnold, o KAN, ha surgido como una alternativa prometedora. Mientras que el diseño antiguo apila capas de funciones fijas, la KAN utiliza curvas flexibles y aprendibles que pueden adaptarse más naturalmente a formas complejas en los datos. La gran pregunta para los investigadores era si este nuevo diseño, más flexible, era también más frágil. Si un modelo es mejor aprendiendo, ¿es también más fácil de engañar? Un equipo de investigadores de la Universidad de Nuevo Brunswick se propuso responder a esto sometiendo varios nuevos diseños de KAN a una serie rigurosa de pruebas de estrés, enfrentándolos a los métodos más fuertes conocidos para engañar a la inteligencia artificial.

Los investigadores se centraron en tres versiones específicas de la arquitectura KAN, cada una construida para realizar tareas visuales como el reconocimiento de objetos en fotos. Probaron estos modelos en dos conjuntos de imágenes estándar: uno que contenía objetos comunes como coches y animales, y otro que contenía números encontrados en señales de tráfico. Para ver qué tan bien resistían estos modelos, el equipo los sometió a tres tipos diferentes de ataques digitales. El primer tipo fue un truco rápido de un solo paso que empujó la imagen en la dirección donde el modelo era más propenso a cometer un error. El segundo tipo fue un ataque más paciente, de múltiples pasos, que refinó el truco una y otra vez hasta encontrar la forma perfecta de confundir al modelo. El tercer tipo fue un ataque de optimización altamente sofisticado que buscó el cambio más pequeño posible necesario para causar un fallo.

Para defenderse de estos trucos, el equipo probó tres estrategias diferentes. La primera consistió en entrenar los modelos mostrándoles tanto imágenes normales como las versiones alteradas y engañosas, obligando al ordenador a aprender cómo ignorar el ruido. La segunda estrategia consistió en añadir una capa de estática aleatoria, o ruido, a las imágenes antes de que el modelo las mirara, emborronando efectivamente los bordes nítidos en los que los atacantes se apoyan. El tercer método consistió en demostrar matemáticamente que la decisión del modelo no cambiaría incluso si la imagen fuera alterada dentro de un cierto límite, creando una red de seguridad que garantizaba la estabilidad.

Los resultados pintaron un panorama claro de cómo se comportan estas nuevas redes bajo presión. Cuando los modelos se dejaban sin ninguna protección especial, eran sorprendentemente frágiles. Incluso los diseños KAN más avanzados podían ser engañados por los ataques más simples, con su precisión cayendo drásticamente a medida que el ruido aumentaba. Sin embargo, cuando los investigadores aplicaron la estrategia de entrenar los modelos con las imágenes engañosas, los resultados cambiaron por completo. Este método, conocido como entrenamiento adversarial, demostró ser el escudo más poderoso. Los modelos que pasaron por este entrenamiento mantuvieron una alta precisión incluso cuando se enfrentaron a los ataques más fuertes, de múltiples pasos. Por ejemplo, en el conjunto de datos de señales de tráfico, un modelo entrenado de esta manera mantuvo su precisión por encima del 67 por ciento incluso cuando el ataque estaba en su máxima fuerza, mientras que la versión no entrenada colapsó hasta llegar casi a cero.

Las otras dos estrategias de defensa ofrecieron distintos tipos de protección. El método que añadía ruido aleatorio a las imágenes no impidió que los modelos fueran engañados de forma tan efectiva como el método de entrenamiento, pero proporcionó un tipo diferente de seguridad. Ofreció una garantía matemática de que la respuesta del modelo no cambiaría si la imagen fuera alterada por una cantidad pequeña y específica. Esto es valioso porque proporciona un límite conocido de seguridad, incluso si el rendimiento general del modelo contra los ataques más fuertes no era tan alto como el de los modelos entrenados. La tercera estrategia, que utilizó límites matemáticos para comprobar la estabilidad, también mejoró la resiliencia de los modelos, pero generalmente se quedó corta frente a la protección ofrecida por el entrenamiento directo de los modelos con los ataques.

Uno de los hallazgos más interesantes fue que la elección de la estructura interna del modelo importaba tanto como la estrategia de defensa. Entre los tres diseños de KAN probados, una arquitectura específica superó consistentemente a las demás. Este diseño particular, que combinaba diferentes formas de mezclar las características de la imagen, resultó ser el más robusto en todas las pruebas. Resistió mejor los trucos rápidos, los ataques pacientes de múltiples pasos y los ataques de optimización sofisticados. Esto sugiere que cambiar simplemente a un nuevo tipo de red no es suficiente; la forma específica en que se construye esa red determina qué tan bien puede resistir un ataque.

El estudio también reveló que la dificultad de la tarea cambiaba el resultado. Los modelos funcionaron significativamente mejor en el conjunto de datos de señales de tráfico que en el de objetos comunes. En las señales de tráfico, incluso los modelos no entrenados fueron sorprendentemente buenos resistiendo los ataques, y los modelos protegidos alcanzaron niveles de precisión superiores al 90 por ciento. Esto indica que algunos tipos de datos visuales son naturalmente más fáciles de manejar de forma segura para estos sistemas que otros.

En última instancia, la investigación muestra que, si bien estas nuevas redes de Kolmogorov-Arnold son herramientas poderosas, no son inmunes al engaño. La forma más fiable de protegerlas es enseñarles qué es un ataque durante su fase de aprendizaje. Aunque otros métodos pueden proporcionar garantías matemáticas de seguridad, no siempre se traducen al mismo nivel de rendimiento en el mundo real contra los trucos más fuertes. El trabajo proporciona una hoja de ruta clara para los desarrolladores: si quieren que estas nuevas y flexibles redes sean seguras, deben integrar sus defensas directamente en el proceso de entrenamiento, asegurando que los modelos aprendan a ver a través del ruido en lugar de simplemente ignorarlo.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →