← Nieuwste papers
🤖 AI

AI Security Research Should Better Incentivize Defense Research

Dit artikel betoogt dat AI-beveiligingsonderzoek lijdt onder een scheve onbalans die aanvalsstudies ten opzichte van verdediging begunstigt door vooroordeel in evaluatiestandaarden, wat een verschuiving in prikkels vereist om de ontwikkeling van praktische en inzetbare beschermingsmaatregelen te prioriteren.

Oorspronkelijke auteurs: Youqian Zhang

Gepubliceerd 2026-05-25
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Youqian Zhang

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Stel je de wereld van de beveiliging van Kunstmatige Intelligentie (KI) voor als een enorm, hoog-risico spel van Slotmakers versus Slotkrakers.

In dit spel zijn er twee soorten onderzoekers:

  1. De Slotkrakers (Aanvalsresearchers): Hun taak is om manieren te vinden om KI-systemen binnen te dringen. Ze zoeken naar scheuren in de deur, kraken de sloten of plagen de beveiligingscamera's.
  2. De Slotmakers (Verdedigingsresearchers): Hun taak is om betere sloten te bouwen, de deuren te versterken en alarmen te creëren die daadwerkelijk werken wanneer iemand probeert in te breken.

Dit artikel, geschreven door Youqian Zhang van de Polytechnische Universiteit van Hongkong, betoogt dat de academische wereld bezeten is van de Slotkrakers en de Slotmakers verwaarloost.

Hier is de uiteenzetting van de belangrijkste punten van het artikel, met behulp van eenvoudige analogieën:

1. Het scorebord is scheef

De auteur telde de onderzoeksartikelen die in toonaangevende beveiligingsconferenties zijn gepubliceerd.

  • De bevindingen: Voor elk artikel dat wordt geschreven over het dichten van een beveiligingsgat, zijn er ongeveer 2 tot 3 artikelen geschreven over hoe dat gat te creëren of te exploiteren.
  • De analogie: Stel je een stad voor waar voor elke persoon die een betere brandblusser uitvindt, er drie mensen zijn die boeken schrijven over hoe je een brand start. De stad wordt zeer bedreven in het begrijpen van hoe branden ontstaan, maar er raken steeds minder mensen over die weten hoe ze ze effectief kunnen blussen.

2. De regels van het spel zijn onfair

Het artikel legt uit dat de "regels" van academische publicatie het veel makkelijker maken om een Slotkraker te zijn dan een Slotmaker.

  • Het probleem van "Eén Treffer" versus "Perfect Schild":

    • Voor Aanvallers: Als je één specifiek KI-model eenmaal kunt kraken onder specifieke omstandigheden, heb je een winnend artikel. Het is alsof je laat zien dat je één slot kunt kraken in een specifiek huis. Dat is genoeg om gepubliceerd te worden.
    • Voor Verdedigers: Om een artikel gepubliceerd te krijgen, moet je bewijzen dat je slot werkt tegen elk type dief, in elk type weer, zonder de deur te vertragen of lelijk te maken. Als je slot faalt tegen slechts één nieuwe truc, kan je artikel worden afgewezen.
    • Het resultaat: Het is veel gemakkelijker om een "winst" te behalen door dingen te breken dan door ze te repareren.
  • Het "Nieuw Speelgoed"-effect:

    • Elke keer dat een nieuw KI-model wordt uitgebracht (zoals een nieuwe videogameconsole), stormen Slotkrakers onmiddellijk naar binnen om bugs te vinden. Dit is spannend en makkelijk over te schrijven.
    • Slotmakers moeten wachten, de bugs bestuderen en vervolgens een oplossing bouwen. Tegen de tijd dat ze publiceren, is het "nieuwe speelgoed" misschien al oud, en wordt de oplossing gezien als "gewoon bijhollen".

3. De "Geheime Industrie"-kloof

Het artikel wijst ook op een verborgen probleem: De Industrie-kloof.

  • De analogie: Stel je Slotmakers voor die werken in geheime overheidslaboratoria of particuliere bedrijven. Ze bouwen eigenlijk geweldige beveiligingssystemen, maar ze kunnen er niet over praten vanwege handelsgeheimen.
  • Ondertussen schreeuwen de Slotkrakers aan de universiteiten over elke kleine kras die ze in het openbaar vinden.
  • De illusie: Omdat het publiek alleen het werk van de Slotkrakers ziet, lijkt het alsof we geen verdediging hebben. Maar het artikel waarschuwt dat, zelfs als er geheime verdedigingen bestaan, de academische wereld niet genoeg kennis deelt over hoe ze te bouwen, waardoor we op de lange termijn kwetsbaar blijven.

4. Waarom is dit belangrijk?

De auteur zegt niet dat we moeten stoppen met het bestuderen van het kraken van KI. We hebben Slotkrakers nodig om de gaten te vinden.

  • Het probleem: We zijn momenteel zo goed in het vinden van gaten dat we mensen tekort komen die ze op een manier die in de echte wereld werkt, daadwerkelijk kunnen dichten.
  • Het risico: Als we ons alleen focussen op het breken van dingen, zullen we een bibliotheek hebben vol met boeken over "Hoe je KI breekt", maar zeer weinig blauwdrukken voor "Hoe je KI beveiligd". Wanneer KI wordt gebruikt voor kritieke zaken zoals zelfrijdende auto's of medische diagnose, is het weten hoe je het kunt breken niet genoeg; we moeten weten hoe we het veilig kunnen maken.

De belangrijkste conclusie

Het artikel pleit voor een verandering in de "incentivestructuur".

  • Huidige staat: Het systeem beloont het vinden van kwetsbaarheden (dingen breken) meer dan het repareren ervan.
  • Voorgestelde verandering: We moeten Verdedigingsonderzoek behandelen als een "eersteklas burger". We moeten het net zo spannend maken, net zo belonen en net zo publiceerbaar maken om een sterk schild te bouwen als het is om een kras in de muur te vinden.

Kortom: We moeten stoppen met alleen tellen hoe vaak we KI kunnen breken, en beginnen met tellen hoe vaak we het succesvol kunnen beschermen.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →