← Últimos artículos
💻 computer science

STRAP-ViT: Segregated Tokens with Randomized -- Transformations for Defense against Adversarial Patches in ViTs

El artículo presenta STRAP-ViT, un método plug-and-play no entrenable para ViTs que defiende contra parches adversarios segregando tokens anómalos mediante divergencia Jensen-Shannon y aplicando transformaciones aleatorias, logrando una robustez comparable a los modelos limpios y superando al estado del arte.

Autores originales: Nandish Chattopadhyay, Anadi Goyal, Chandan Karfa, Anupam Chattopadhyay

Publicado 2026-03-17
📖 4 min de lectura☕ Lectura para el café

Autores originales: Nandish Chattopadhyay, Anadi Goyal, Chandan Karfa, Anupam Chattopadhyay

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina que tienes un detective muy inteligente (llamémoslo "ViT") que trabaja en una oficina de seguridad. Este detective es excelente mirando fotos y diciendo qué hay en ellas: "¡Eso es un mono!", "¡Eso es un radiador!". Funciona tan bien porque no mira la foto como un todo borroso, sino que la divide en miles de pequeños fragmentos o "trozos" (llamados tokens), y analiza cada uno de ellos para entender la historia completa.

Pero, los ladrones (los ciberdelincuentes) han encontrado una forma de engañar a este detective.

El Problema: La "Pegatina Mágica" (El Parche Adversarial)

Imagina que un ladrón pega una pequeña pegatina brillante y extraña en la frente de una persona en una foto.

  • En el mundo real, si pones una pegatina en la frente de alguien, el detective sigue viéndolo como una persona.
  • Pero para este detective digital, esa pegatina es como un grito estridente. El detective se obsesiona con ese brillo, ignora todo lo demás (la cara, el cuerpo) y grita: "¡Eso no es una persona, es un radiador!".

Aunque la pegatina sea muy pequeña, el detective cambia su respuesta con total seguridad. Esto es peligroso si ese detective controla un coche autónomo o una cámara de seguridad.

La Solución: STRAP-ViT (El Escudo Invisible)

Los autores de este paper, Nandish y su equipo, crearon un nuevo sistema de defensa llamado STRAP-ViT. No necesitan reentrenar al detective ni cambiar su cerebro. Solo le ponen un filtro inteligente antes de que tome su decisión final.

Aquí te explico cómo funciona STRAP-ViT con una analogía sencilla:

1. El Detector de "Ruido" (Fase de Detección)

Imagina que el detective está leyendo su lista de trozos de la foto. El sistema STRAP-ViT actúa como un guardia de seguridad que revisa cada trozo.

  • Los trozos normales (la cara, el fondo) tienen una "voz" tranquila y predecible.
  • Los trozos que tocan la pegatina mágica tienen una "voz" muy rara, estridente y desordenada (como si alguien estuviera gritando en una biblioteca).

El sistema usa una herramienta matemática llamada Divergencia de Jensen-Shannon (suena complicado, pero es como un medidor de rareza). Si un trozo suena demasiado "raro" comparado con los demás, el guardia lo marca: "¡Ese trozo es sospechoso!".

2. El Transformador Aleatorio (Fase de Mitigación)

Una vez que el guardia identifica los trozos sospechosos (los que tocan la pegatina), no los borra (porque eso dejaría un agujero en la foto). En su lugar, les aplica un tratamiento de choque aleatorio.

Imagina que tienes un grupo de espías (los trozos sospechosos) que están intentando enviar un mensaje secreto. El sistema STRAP-ViT les hace lo siguiente:

  • A veces les cambia el acento.
  • A veces les cambia el volumen.
  • A veces les hace girar en círculos.

Lo mejor es que el sistema elige al azar qué tratamiento aplicar cada vez.

  • Si el ladrón intenta entrenar su pegatina para resistir un cambio de volumen, el sistema le dará un cambio de acento.
  • Si intenta resistir el acento, le darán un giro.

Como el ladrón no sabe qué va a pasar, su pegatina mágica deja de funcionar. Se vuelve inofensiva. El detective vuelve a ver la foto con claridad y dice: "Ah, sí, es un mono".

¿Por qué es tan genial esto?

  1. Es como un "Plug-and-Play" (Enchufar y usar): No necesitas construir un nuevo detective ni gastar millones en entrenarlo. Solo pones este escudo delante del detective que ya tienes y listo.
  2. Es muy preciso: Solo toca los trozos que están "enfermos" (la pegatina). Si la foto está limpia, el sistema apenas la toca, por lo que el detective sigue siendo tan rápido y preciso como siempre.
  3. Es barato: El cálculo que hace es muy ligero, como un susurro comparado con el grito que hace el detective para analizar la foto completa.

En resumen

STRAP-ViT es como poner unos gafas de sol inteligentes a un detective de seguridad.

  • Si la foto está limpia, las gafas son transparentes y no estorban.
  • Si alguien intenta engañarlo con una pegatina brillante, las gafas detectan el brillo extraño, giran la imagen de ese trozo específico de forma aleatoria y confunden al ladrón.
  • El resultado: El detective vuelve a ver la verdad, sin importar qué pegatina intenten ponerle.

Los autores probaron esto con fotos de internet (como las de ImageNet) y con diferentes tipos de pegatinas maliciosas, y funcionó increíblemente bien, recuperando la precisión casi al 100% incluso cuando los ladrones intentaban engañarlo. ¡Es una victoria para la seguridad de la inteligencia artificial!

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →