← Nieuwste papers
💬 NLP

Benchmarking Large Language Models for Cryptanalysis and Side-Channel Vulnerabilities

Dit artikel introduceert een benchmark-dataset om de cryptanalytische vermogens en de generalisatievaardigheden van state-of-the-art grote taalmodellen over diverse encryptiealgoritmen heen te evalueren, waarbij hun potentiële kwetsbaarheden voor under-generalization-aanvallen worden onthuld en de dual-use beveiligingsrisico's van AI in cryptografische contexten worden benadrukt.

Oorspronkelijke auteurs: Utsav Maskey, Chencheng Zhu, Usman Naseem

Gepubliceerd 2026-06-02
📖 6 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Utsav Maskey, Chencheng Zhu, Usman Naseem

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je voor dat je een gigantische, superintelligente robotbibliothecaris hebt (een Large Language Model, of LLM) die bijna elk boek op aarde heeft gelezen. Je stelt het een simpele vraag en het antwoordt perfect. Maar wat gebeurt er als je het een bericht geeft dat in een geheime code is geschreven? Kan het de code kraken, of staart het er alleen maar glazig naar?

Dit artikel is als een "stress-test" voor deze robotbibliothecarissen. De onderzoekers hebben een enorme speeltuin van geheime berichten gebouwd om te zien hoe goed deze AI-modellen kunnen optreden als codebrekers. Hier is het verhaal van wat ze ontdekten, eenvoudig uitgelegd.

De Speeltuin: Een Mix van Geheime Codes

De onderzoekers creëerden een enorme dataset van 4.509 geheime berichten. Denk aan dit als een bibliotheek vol met vergrendelde dozen.

  • De Inhoud: In de dozen zaten normale zinnen over wetenschap, nieuws, Shakespeare en zelfs grappen.
  • De Slotjes: Ze vergrendelden deze zinnen met 9 verschillende soorten "sloten" (encryptiemethoden).
    • Makkelijke sloten: Zoals een eenvoudige alfabetverschuiving (Caesar-cijfer) of Morsecode (punten en streepjes).
    • Gemiddelde sloten: Zoals het herordenen van letters in een raster (Rail Fence) of het gebruiken van een geheim trefwoord (Vigenère).
    • Moeilijke sloten: Zoals de hoogtechnologische digitale sloten die vandaag de dag worden gebruikt om banken te beveiligen (RSA en AES).

De Test: Kan de Robot het Slot Openen?

De onderzoekers vroegen verschillende AI-modellen (zoals de breinen achter ChatGPT, Claude en Gemini) om te proberen deze dozen te openen. Ze testten dit op twee manieren:

  1. Zero-Shot: "Hier is een vergrendelde doos. Open hem." (Geen hulp gegeven).
  2. Few-Shot: "Hier is een vergrendelde doos en de sleutel ervan. Nu is hier een andere vergrendelde doos. Open deze." (Een hint gegeven).

Wat Ze Vonden: De Valstrik van "Gedeeltelijk Begrip"

1. De "Bekendheid"-bias
De robots waren erg goed in het openen van de "makkelijke" sloten die ze miljoenen keren hadden gezien in hun trainingsdata.

  • De Analogie: Stel je een kind voor dat al duizend keer een rode deur heeft gezien. Als je het een rode deur laat zien, weet het hoe de deur te openen. Maar als je het een blauwe deur laat zien die precies hetzelfde werkt, kan het kind bevriezen.
  • Het Resultaat: De AI's konden het "Caesar"-cijfer (letters verschuiven met 3) gemakkelijk kraken omdat ze dit vaak zagen. Maar ze hadden moeite met het "Atbash"-cijfer (het alfabet omdraaien), ook al is dat net zo eenvoudig. Ze hadden simpelweg niet genoeg van dat specifieke patroon gezien om te kunnen generaliseren.

2. Het "Token Inflatie"-probleem
Sommige codes maken het bericht veel langer dan het eigenlijk is.

  • De Analogie: Stel je voor dat je een kort briefje schrijft: "Hallo." Maar de code verandert het in een boek van 50 pagina's vol symbolen. De robot raakt overweldigd door de poging om het hele boek te lezen om dat ene woord te vinden.
  • Het Resultaat: Codes zoals Morsecode of de Bacon-cijfer (die letters veranderen in lange reeksen punten/streepjes of A/B-patronen) maakten de tekst enorm groot. De AI's raakten in de war omdat de "woorden" te lang en vreemd werden voor hen om te verwerken, zelfs als de logica simpel was.

3. Het Gevaar van "Bijna Daar Zijn" (Partiële Begrip)
Dit is de belangrijkste bevinding. Zelfs wanneer de AI de doos niet perfect kon openen, begreep het vaak wat erin zat.

  • De Analogie: Stel je een robot voor die probeert een vreemde taal te vertalen. De robot krijgt de zinsstructuur wel goed en begrijpt de algemene sfeer, maar vervangt één woord door een woord dat er qua klank op lijkt. Het is geen perfecte vertaling, maar het is goed genoeg om gevaarlijk te zijn.
  • Het Resultaat: De AI's konden vaak de betekenis van de geheime boodschap raden, zelfs als ze de exacte letters niet terug konden schrijven. Bijvoorbeeld: ze veranderden "Patients with hypertension..." in "Patience with your expectations...". Ze kregen de idee goed, ook al waren de woorden fout.

4. Het "Hint"-effect (Few-Shot Learning)
Wanneer de onderzoekers de robots één voorbeeld gaven van hoe een specifiek slot geopend moest worden, werden de robots er veel beter in.

  • De Analogie: Als je een robot één keer laat zien hoe je een specifiek type slot opent, kan de robot vaak uitzoeken hoe hij datzelfde type slot op een andere deur moet openen.
  • Het Resultaat: Dit is een tweesnijdend zwaard. Het betekent dat als een kwaadwillende actor de AI een "hint" geeft over hoe hij veiligheidsregels kan omzeilen met behulp van een geheime code, de AI dit direct kan leren doen.

De Belangrijkste Les: Veiligheid versus Slimheid

Het artikel concludeert met een waarschuwing over hoe we AI-veiligheid meten.

  • De Paradox: Meestal willen we dat een AI slim is en alles begrijpt. Maar in de wereld van beveiliging is het een risico om te goed te zijn in het begrijpen van geheime codes.
  • Het Risico: Als een AI een geheime boodschap "gedeeltelijk kan begrijpen", kan een kwaadwillende actor een schadelijke instructie in een code verstoppen. De AI hoeft de code niet perfect te ontcijferen, maar het begrijpt misschien genoeg om de schadelijke instructie op te volgen.
  • De Les: We moeten deze robots leren om voorzichtig te zijn. Alleen omdat ze de betekenis van een gecodeerd bericht kunnen "raden", betekent niet dat ze er ook naar moeten handelen. Het artikel suggereert dat we voor de veiligheid misschien juist willen dat deze modellen slechter zijn in het kraken van codes die ze nog niet eerder hebben gezien, zodat ze niet per ongelieve slechte dingen door de mazen van het net laten glippen.

Kortom: Deze superintelligente AI-robots zijn geweldig in het lezen van boeken, maar als het gaat om geheime codes, zijn ze als kinderen die de regels van het ene spel kennen, maar in de war raken wanneer de regels een klein beetje veranderen. Het enge is dat ze niet perfect hoeven te zijn om bedrogen te worden; alleen maar "goed genoeg" om de essentie te begrijpen, is al genoeg om problemen te veroorzaken.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →