← Últimos artículos
🤖 machine learning

Fool Me If You Can: On the Robustness of Binary Code Similarity Detection Models against Semantics-preserving Transformations

El artículo presenta asmFooler, un sistema que evalúa la vulnerabilidad de los modelos de detección de similitud de código binario frente a transformaciones que preservan la semántica, demostrando que estas alteraciones mínimas pueden engañar eficazmente a los modelos al explotar sus limitaciones en el preprocesamiento y la selección de características.

Autores originales: Jiyong Uhm, Minseok Kim, Michalis Polychronakis, Hyungjoon Koo

Publicado 2026-02-16
📖 5 min de lectura🧠 Análisis profundo

Autores originales: Jiyong Uhm, Minseok Kim, Michalis Polychronakis, Hyungjoon Koo

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina que tienes un traductor de idiomas muy avanzado (un modelo de Inteligencia Artificial) diseñado para leer programas de computadora (código binario) y decirte si dos programas son "primos gemelos" (iguales) o "extraños" (diferentes), incluso si no tienes el libro de instrucciones original (el código fuente).

Este traductor es vital para la ciberseguridad: ayuda a los investigadores a encontrar virus ocultos o a descubrir si alguien ha copiado ilegalmente un software.

Pero, ¿qué pasa si un hacker es un maestro del disfraz?

El Gran Truco: "Engáñame si puedes"

Los autores de este estudio (un equipo de investigadores de Corea y EE. UU.) se preguntaron: ¿Qué tan bueno es nuestro traductor si el hacker cambia la ropa del programa sin cambiar su personalidad?

En el mundo de la programación, esto se llama transformación que preserva la semántica. Es como si un actor cambiara su peluca, su chaqueta y su acento, pero siguiera contando exactamente la misma historia con las mismas acciones. Para una computadora, el programa sigue haciendo lo mismo, pero para el "traductor" (la IA), ahora parece una persona totalmente distinta.

Para probar esto, crearon un sistema llamado asmFooler (el "tonto de ensamblaje"). Su misión fue intentar engañar a 6 de los mejores traductores de IA actuales.

Las 4 Claves del Truco (Analogías)

Los investigadores probaron varias formas de disfrazar el código. Aquí te explico cómo funcionan con analogías de la vida real:

  1. El Cambio de Orden (Reordenamiento):

    • La analogía: Imagina que tienes una receta de cocina. Puedes escribir los pasos en orden: "1. Calentar sartén, 2. Poner huevo, 3. Freír". O puedes escribirlo así: "1. Poner huevo, 2. Freír, 3. Calentar sartén" (si el contexto lo permite). El resultado final es el mismo plato, pero el texto es diferente.
    • El resultado: Algunos traductores de IA se confundieron mucho al ver los pasos en otro orden, pensando que era una receta diferente.
  2. El Relleno Inútil (Código Basura / NOP):

    • La analogía: Es como si, antes de empezar a contar un chiste, el actor hiciera 100 gestos extraños, se ajustara la corbata 5 veces y respirara hondo, pero sin decir nada que cambie el chiste.
    • El resultado: Algunos traductores se marearon con tanto "ruido" y dejaron de entender la esencia del chiste.
  3. El Laberinto Falso (Ocultar el Camino):

    • La analogía: Imagina un mapa de metro. El hacker añade muchas estaciones fantasma o cambia las señales para que parezca que el tren va por un camino diferente, aunque en realidad llega a la misma parada.
    • El resultado: Los traductores que dependen de ver el "mapa" (la estructura del programa) se perdieron en el laberinto y fallaron.
  4. El Sustituto Perfecto:

    • La analogía: En lugar de decir "Caminar rápido", el hacker dice "Correr despacio". Son palabras diferentes, pero significan lo mismo.
    • El resultado: Si el traductor no entiende bien los sinónimos, pensará que son dos acciones distintas.

¿Qué Descubrieron? (Las Sorpresas)

  1. No todos los traductores son iguales:
    Algunos modelos de IA son muy rígidos. Si cambias el orden de las palabras (instrucciones), fallan. Otros son más flexibles y entienden que el orden no importa tanto. Depende de cómo fueron "entrenados" y qué "lentes" usan para ver el código.

  2. El presupuesto del disfraz:
    Hay un límite. El hacker no puede cambiar todo el programa, solo puede añadir o cambiar una cierta cantidad de "ropa" (instrucciones). Si cambia demasiado, el programa deja de funcionar. Pero, ¡y esto es importante! Con muy pocos cambios (incluso añadiendo solo 15 instrucciones extra), lograron engañar a los modelos casi el 100% de las veces.

  3. El ataque inverso (Hacer que lo malo parezca bueno):
    Lo más peligroso fue cuando intentaron hacer que un programa malicioso (un virus) pareciera inofensivo para la IA. Usaron una estrategia de "muestreo codicioso" (como un detective que prueba una y otra vez hasta encontrar la combinación perfecta).

    • Resultado: Lograron que la IA dijera "¡Esto es seguro!" cuando en realidad era un virus, añadiendo muy poco código extra.
  4. El efecto dominó:
    Si lograban engañar a un modelo de IA, a menudo también engañaban a otros modelos similares. Es como si aprendieras a disfrazarte para un guardia de seguridad y, por casualidad, ese mismo disfraz funcionara para otro guardia que usa el mismo tipo de uniforme.

¿Por qué importa esto?

Este estudio nos dice que la Inteligencia Artificial en ciberseguridad no es invencible.

  • El problema: Si los hackers saben cómo disfrazar sus programas, pueden pasar desapercibidos.
  • La solución: Los futuros sistemas de seguridad no pueden confiar solo en una sola forma de ver el código. Necesitan ser más inteligentes, entender el "alma" del programa (su comportamiento real) y no solo su "ropa" (las instrucciones escritas).

En resumen: Los hackers pueden usar el disfraz perfecto para engañar a la IA, pero los investigadores ahora saben exactamente qué tipo de disfraces funcionan mejor, lo que nos ayuda a construir mejores detectores para el futuro.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →