← Derniers articles
💬 NLP

Benchmarking Large Language Models for Cryptanalysis and Side-Channel Vulnerabilities

Cet article introduit un ensemble de données de référence pour évaluer les capacités de cryptanalyse et les capacités de généralisation des modèles de langage de pointe à travers divers algorithmes de chiffrement, révélant leurs vulnérabilités potentielles face aux attaques par sous-généralisation et soulignant les risques de sécurité liés au double usage de l'IA dans les contextes cryptographiques.

Auteurs originaux : Utsav Maskey, Chencheng Zhu, Usman Naseem

Publié 2026-06-02
📖 6 min de lecture🧠 Analyse approfondie

Auteurs originaux : Utsav Maskey, Chencheng Zhu, Usman Naseem

Article original sous licence CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Ceci est une explication générée par l'IA de l'article ci-dessous. Elle n'a pas été rédigée ni approuvée par les auteurs. Pour une précision technique, consultez l'article original. Lire la clause de non-responsabilité complète

Imaginez que vous avez un robot bibliothécaire géant et super intelligent (un grand modèle de langage, ou LLM) qui a lu presque tous les livres de la Terre. Vous lui posez une question simple, et il répond parfaitement. Mais que se passe-t-il si vous lui donnez un message écrit dans un code secret ? Peut-il déchiffrer le code, ou reste-t-il simplement là à le regarder sans réaction ?

Ce document est comme un « test de résistance » pour ces bibliothécaires robots. Les chercheurs ont construit un immense terrain de jeu de messages secrets pour voir si ces modèles d'IA peuvent agir comme des casseurs de codes. Voici l'histoire de ce qu'ils ont découvert, expliquée simplement.

Le Terrain de Jeu : Un mélange de codes secrets

Les chercheurs ont créé un ensemble massif de données de 4 509 messages secrets. Considérez cela comme une bibliothèque de boîtes verrouillées.

  • Le Contenu : À l'intérieur des boîtes se trouvaient des phrases normales sur la science, l'actualité, Shakespeare et même des blagues.
  • Les Verrous : Ils ont verrouillé ces phrases à l'aide de 9 types de « verrous » différents (méthodes de chiffrement).
    • Verrous Faciles : Comme un simple échange d'alphabet (chiffre de César) ou du code Morse (points et tirets).
    • Verrous Moyens : Comme le réarrangement de lettres dans une grille (Rail Fence) ou l'utilisation d'un mot-clé secret (Vigenère).
    • Verrous Difficiles : Comme les verrous numériques de haute technologie utilisés aujourd'hui pour sécuriser les banques (RSA et AES).

Le Test : Le robot peut-il crocheter la serrure ?

Les chercheurs ont demandé à divers modèles d'IA (comme les cerveaux derrière ChatGPT, Claude et Gemini) d'essayer d'ouvrir ces boîtes. Ils les ont testés de deux manières :

  1. Zero-Shot (Sans aide) : « Voici une boîte verrouillée. Ouvre-la. » (Aucune aide donnée).
  2. Few-Shot (Avec quelques exemples) : « Voici une boîte verrouillée et sa clé. Maintenant, voici une autre boîte verrouillée. Ouvre celle-ci. » (En leur donnant un indice).

Ce qu'ils ont trouvé : Le piège de la « compréhension partielle »

1. Le biais de « familiarité »
Les robots étaient excellents pour ouvrir les verrous « Faciles » qu'ils avaient vus un million de fois dans leurs données d'entraînement.

  • L'analogie : Imaginez un enfant qui a vu une porte rouge mille fois. Si vous lui montrez une porte rouge, il sait comment l'ouvrir. Mais si vous lui montrez une porte bleue qui fonctionne exactement de la même manière, il pourrait se figer.
  • Le résultat : Les IA pouvaient facilement casser le chiffre « César » (décalage de lettres de 3) parce qu'elles l'avaient souvent vu. Mais elles avaient du mal avec le chiffre « Atbash » (inversion de l'alphabet), même s'il est tout aussi simple. Elles n'avaient juste pas vu ce motif spécifique assez souvent pour généraliser.

2. Le problème de « l'inflation de tokens »
Certains codes font en sorte que le message paraisse beaucoup plus long qu'il ne l'est réellement.

  • L'analogie : Imaginez que vous écriviez une courte note : « Bonjour ». Mais le code transforme cela en un livre de 50 pages de symboles. Le robot est submergé en essayant de lire tout le livre pour trouver le seul mot.
  • Le résultat : Les codes comme le Morse ou le chiffre de Bacon (qui transforment les lettres en de longues chaînes de points/tirets ou de motifs A/B) rendaient le texte énorme. Les IA étaient confuses car les « mots » devenaient trop longs et étranges pour qu'elles puissent les gérer, même si la logique était simple.

3. Le danger du « Presque Là » (Compréhension Partielle)
C'est la découverte la plus importante. Même quand l'IA ne pouvait pas déverrouiller parfaitement la boîte, elle comprenait souvent ce qu'il y avait à l'intérieur.

  • L'analogie : Imaginez un robot essayant de traduire une langue étrangère. Il comprend bien la structure de la phrase et l'ambiance générale, mais il remplace un mot par un autre qui sonne de façon similaire. Ce n'est pas une traduction parfaite, mais c'est assez proche pour être dangereux.
  • Le résultat : Les IA pouvaient souvent deviner le sens du message secret même si elles ne pouvaient pas réécrire les lettres exactes. Par exemple, elles pourraient transformer « Patients avec hypertension... » en « Patience avec vos attentes... ». Elles comprenaient l'idée, même si les mots étaient faux.

4. L'effet du « Indice » (Apprentissage Few-Shot)
Lorsque les chercheurs ont donné aux robots un seul exemple de la façon d'ouvrir un verrou spécifique, les robots sont devenus bien meilleurs pour cela.

  • L'analogie : Si vous montrez à un robot comment crocheter un type de serrure spécifique une seule fois, il peut souvent comprendre comment crocheter ce même type de serrure sur une autre porte.
  • Le résultat : C'est une arme à double tranchant. Cela signifie que si un acteur malveillant donne un « indice » à l'IA sur la façon de contourner les règles de sécurité en utilisant un code secret, l'IA pourrait apprendre à le faire instantanément.

La grande conclusion : Sécurité vs Intelligence

Le document conclut par un avertissement sur la façon dont nous mesurons la sécurité de l'IA.

  • Le Paradoxe : Habituellement, nous voulons qu'une IA soit intelligente et comprenne tout. Mais dans le monde de la sécurité, être trop douée pour comprendre les codes secrets est un risque.
  • Le Risque : Si une IA peut « partiellement comprendre » un message secret, un acteur malveillant pourrait cacher une instruction nuisible à l'intérieur d'un code. L'IA ne le déchiffrera peut-être pas parfaitement, mais elle pourrait comprendre suffisamment pour suivre l'instruction malveillante.
  • La Leçon : Nous devons apprendre à ces robots à être prudents. Ce n'est pas parce qu'ils peuvent « deviner » le sens d'un message brouillé qu'ils doivent agir en conséquence. Le document suggère que, pour la sécurité, nous voudrions peut-être que ces modèles soient en fait moins bons pour casser des codes qu'ils n'ont pas vus auparavant, afin qu'ils ne laissent pas accidentellement passer de mauvaises choses à travers les mailles du filet.

En bref : Ces robots d'IA super intelligents sont excellents pour lire des livres, mais lorsqu'il s'agit de codes secrets, ils sont comme des enfants qui connaissent les règles d'un jeu mais qui sont confus lorsque les règles changent légèrement. La partie effrayante est qu'ils n'ont pas besoin d'être parfaits pour être piégés ; être juste « assez bon » pour comprendre l'essentiel suffit à causer des problèmes.

Noyé(e) sous les articles dans votre domaine ?

Recevez des digests quotidiens des articles les plus récents correspondant à vos mots-clés de recherche — avec des résumés techniques, dans votre langue.

Essayer Digest →