← Últimos artículos
💬 NLP

Benchmarking Large Language Models for Cryptanalysis and Side-Channel Vulnerabilities

Este artículo presenta un conjunto de datos de referencia para evaluar las capacidades criptoanalíticas y las habilidades de generalización de los modelos de lenguaje de gran tamaño de vanguardia a través de diversos algoritmos de cifrado, revelando sus vulnerabilidades potenciales ante ataques de subgeneralización y destacando los riesgos de seguridad de doble uso de la IA en contextos criptográficos.

Autores originales: Utsav Maskey, Chencheng Zhu, Usman Naseem

Publicado 2026-06-02
📖 5 min de lectura🧠 Análisis profundo

Autores originales: Utsav Maskey, Chencheng Zhu, Usman Naseem

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina que tienes un bibliotecario robot gigante y superinteligente (un Modelo de Lenguaje Extenso, o LLM) que ha leído casi todos los libros de la Tierra. Le haces una pregunta sencilla y responde perfectamente. Pero, ¿qué pasa si le entregas un mensaje escrito en un código secreto? ¿Puede descifrar el código o se queda mirándolo fijamente sin entender nada?

Este artículo es como una "prueba de esfuerzo" para estos bibliotecarios robot. Los investigadores construyeron un patio de juegos gigante de mensajes secretos para ver qué tan bien pueden actuar estos modelos de IA como descifradores de códigos. Esta es la historia de lo que encontraron, explicada de forma sencilla.

El Patio de Juegos: Una Mezcla de Códigos Secretos

Los investigadores crearon un conjunto de datos masivo de 4,509 mensajes secretos. Piensa en esto como una biblioteca de cajas cerradas con llave.

  • El Contenido: Dentro de las cajas había frases normales sobre ciencia, noticias, Shakespeare e incluso chistes.
  • Los Candados: Cerraron estas frases usando 9 tipos diferentes de "candados" (métodos de cifrado).
    • Candados Fáciles: Como un simple intercambio de alfabeto (cifrado César) o código Morse (puntos y rayas).
    • Candados Medios: Como reorganizar letras en una cuadrícula (Rail Fence) o usar una palabra clave secreta (Vigenère).
    • Candados Difíciles: Como los candados digitales de alta tecnología que se usan hoy para asegurar los bancos (RSA y AES).

La Prueba: ¿Puede el Robot Abrir el Candado?

Los investigadores pidieron a varios modelos de IA (como los cerebros detrás de ChatGPT, Claude y Gemini) que intentaran abrir estas cajas. Los probaron de dos maneras:

  1. Zero-Shot (Sin ejemplos): "Aquí hay una caja cerrada. Ábrela". (Sin ayuda previa).
  2. Few-Shot (Con pocos ejemplos): "Aquí hay una caja cerrada y su llave. Ahora, aquí hay otra caja cerrada. Abre esta". (Dándoles una pista).

Lo Que Encontraron: La Trampa del "Entendimiento Parcial"

1. El Sesgo de la "Familiaridad"
Los robots fueron excelentes abriendo los candados "Fáciles" que habían visto un millón de veces en sus datos de entrenamiento.

  • La Analogía: Imagina a un niño que ha visto una puerta roja mil veces. Si le muestras una puerta roja, sabe cómo abrirla. Pero si le muestras una puerta azul que funciona exactamente de la misma manera, podría quedarse paralizado.
  • El Resultado: Las IA podían descifrar fácilmente el cifrado "Caesar" (desplazar letras por 3) porque lo veían a menudo. Pero tuvieron dificultades con el cifrado "Atbash" (revertir el alfabeto), aunque es igual de simple. Simplemente no habían visto ese patrón específico lo suficiente como para generalizarlo.

2. El Problema de la "Inflación de Tokens"
Algunos códigos hacen que el mensaje parezca mucho más largo de lo que realmente es.

  • La Analogía: Imagina que escribes una nota corta: "Hola". Pero el código la convierte en un libro de 50 páginas de símbolos. El robot se siente abrumado tratando de leer todo el libro para encontrar la única palabra.
  • El Resultado: Los códigos como el Morse o el cifrado de Bacon (que convierten letras en largas cadenas de puntos/rayas o patrones de A/B) hicieron que el texto fuera enorme. Las IA se confundieron porque las "palabras" se volvieron demasiado largas y extrañas para que pudieran manejarlas, incluso si la lógica era simple.

3. El Peligro de "Estar Cerca" (Comprensión Parcial)
Este es el hallazgo más importante. Incluso cuando la IA no podía abrir la caja perfectamente, a menudo entendía qué había dentro.

  • La Analogía: Imagina a un robot intentando traducir un idioma extranjero. Entiende la estructura de la oración y la idea general, pero cambia una palabra por otra que suena similar. No es una traducción perfecta, pero es lo suficientemente cercana como para ser peligrosa.
  • El Resultado: Las IA a menudo podían adivinar el significado del mensaje secreto incluso si no podían escribir las letras exactas de vuelta. Por ejemplo, podrían convertir "Pacientes con hipertensión..." en "Paciencia con sus expectativas...". Captaban la idea, aunque las palabras fueran incorrectas.

4. El Efecto de la "Pista" (Aprendizaje Few-Shot)
Cuando los investigadores le dieron a los robots un solo ejemplo de cómo abrir un candado específico, los robots mejoraron mucho en ello.

  • La Analogía: Si le muestras a un robot cómo abrir un tipo específico de candado una vez, a menudo puede descubrir cómo abrir ese mismo tipo de candado en una puerta diferente.
  • El Resultado: Esto es un arma de doble filo. Significa que si un actor malintencionado le da a la IA una "pista" sobre cómo saltarse las reglas de seguridad usando un código secreto, la IA podría aprender a hacerlo instantáneamente.

La Gran Conclusión: Seguridad vs. Inteligencia

El artículo concluye con una advertencia sobre cómo medimos la seguridad de la IA.

  • La Paradoja: Normalmente, queremos que una IA sea inteligente y entienda todo. Pero en el mundo de la seguridad, ser demasiado buena entendiendo códigos secretos es un riesgo.
  • El Riesgo: Si una IA puede "entender parcialmente" un mensaje secreto, un actor malintencionado podría esconder una instrucción dañina dentro de un código. La IA podría no descifrarlo perfectamente, pero podría entender lo suficiente como para seguir la instrucción dañina.
  • La Lección: Necesitamos enseñar a estos robots a ser cuidadosos. El hecho de que puedan "adivinar" el significado de un mensaje codificado no significa que deban actuar según él. El artículo sugiere que, para la seguridad, quizás desearíamos que estos modelos fueran peores descifrando códigos que no han visto antes, para que no dejen pasar cosas malas por accidente.

En resumen: Estos robots de IA superinteligentes son excelentes leyendo libros, pero cuando se trata de códigos secretos, son como niños que conocen las reglas de un juego pero se confunden cuando las reglas cambian ligeramente. La parte aterradora es que no necesitan ser perfectos para ser engañados; con ser "suficientemente buenos" para entender la esencia es suficiente para causar problemas.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →