← Nieuwste papers
💬 NLP

Is Vibe Coding Safe? Benchmarking Vulnerability of Agent-Generated Code in Real-World Tasks

Deze studie toont aan dat 'vibe coding' met LLM-agenten ernstige veiligheidsrisico's met zich meebrengt, aangezien de gegenereerde code vaak functioneel correct is maar kwetsbaar voor beveiligingsproblemen, zelfs bij gebruik van geavanceerde modellen en beveiligingsstrategieën.

Oorspronkelijke auteurs: Songwen Zhao, Danqing Wang, Kexun Zhang, Jiaxuan Luo, Zhuo Li, Lei Li

Gepubliceerd 2026-02-18
📖 4 min leestijd☕ Koffiepauze-leesvoer

Oorspronkelijke auteurs: Songwen Zhao, Danqing Wang, Kexun Zhang, Jiaxuan Luo, Zhuo Li, Lei Li

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer

Titel: Is "Vibe Coding" veilig? Een onderzoek naar de gevaren van AI-programmeren

Stel je voor dat je een nieuwe kamer wilt laten bouwen in je huis. In plaats van zelf de blauwdrukken te tekenen of een vakman in te huren, geef je gewoon een mondopdracht aan een super-snelle, slimme robot: "Bouw een kamer met een raam en een deur, en zorg dat het veilig is."

Dit noemen de auteurs van dit onderzoek "Vibe Coding". Het is een nieuwe manier van programmeren waarbij mensen (vaak zonder veel ervaring) instructies geven aan een kunstmatige intelligentie (AI), die dan de hele code schrijft. Het klinkt geweldig en snel, maar de vraag is: Is wat die robot bouwt wel veilig?

Dit paper, getiteld "Is Vibe Coding Safe?", gaat op zoek naar het antwoord. Hier is wat ze hebben ontdekt, vertaald in begrijpelijke taal:

1. Het Experiment: De "SUSVIBES" Testbaan

De onderzoekers wilden niet zomaar een paar regels code testen. Ze wilden zien of AI's complexe gebouwen (grote softwareprojecten) veilig kunnen bouwen.

Ze bouwden een speciale testbaan genaamd SUSVIBES.

  • Het idee: Ze namen 200 echte, bestaande software-projecten (zoals grote bibliotheken of webtools).
  • De truc: Ze namen bekende veiligheidsfouten uit het verleden, verwijderden de oplossing, en gaven de opdracht aan de AI: "Maak deze functie weer veilig."
  • De test: De AI probeerde de functie te bouwen. Daarna werd gekeken:
    1. Werkt het? (De deur gaat open, het licht gaat aan).
    2. Is het veilig? (Kan niemand door de muur breken of de deur openen zonder sleutel?)

2. Het Schokkende Resultaat: "Het werkt, maar het is een lekke boot"

De resultaten waren verontrustend. De AI's waren heel goed in het bouwen van de kamer, maar vergeten de sloten op de deur te zetten.

  • De cijfers: De beste AI (een combinatie van een slim model en een agent) slaagde in 61% van de gevallen om de functie werkend te maken.
  • Het probleem: Van die werkende oplossingen was maar 10,5% daadwerkelijk veilig.
  • De conclusie: In 80% tot 90% van de gevallen bouwde de AI een oplossing die wel deed wat er gevraagd werd, maar die volzat met gaten waar hackers doorheen kunnen klimmen.

Het is alsof de AI een prachtige auto bouwt die perfect rijdt, maar de remmen zijn vergeten of de deuren sluiten niet goed. Als je erin stapt, is het een ramp.

3. Waarom lukt het niet?

De onderzoekers probeerden verschillende trucs om de AI veiliger te maken:

  • "Wees voorzichtig": Ze gaven de AI een herinnering: "Vergeet de veiligheid niet!"
  • "Kijk naar de lijst met fouten": Ze gaven de AI een lijst met bekende fouten (zoals een lijst met inbraakmethoden) en vroegen: "Pas hierop op."
  • "Hier is de exacte fout": Ze gaven de AI zelfs de naam van de specifieke fout die ze moesten voorkomen.

Het resultaat? Niets hielp echt. Sterker nog, als ze de AI te veel over veiligheid lieten nadenken, begon de AI de werkende functie te vergeten. Het werd ofwel onveilig, ofwel het werkde helemaal niet meer. De AI raakte in de war tussen "doen wat gevraagd wordt" en "niet fouten maken".

4. Wat betekent dit voor ons?

De term "Vibe Coding" klinkt ontspannen, alsof je gewoon in je stoel zit en de AI de zware arbeid doet. Maar dit onderzoek zegt: Pas op.

  • Geen "Zet het maar op de automatische piloot": Als je AI code schrijft voor dingen die belangrijk zijn (zoals wachtwoorden, bankzaken of persoonlijke data), kun je niet zomaar vertrouwen op wat de AI produceert.
  • De mens moet de controle houden: Omdat de AI zo vaak veilige gaten laat, moet een menselijke expert de code altijd controleren. Maar hier zit het probleem: veel mensen die "vibe coding" gebruiken, zijn beginners die niet weten waar ze naar moeten kijken. Ze zien een werkende code en denken: "Top, het werkt!" terwijl ze over een mijn lopen.

Samenvatting in één zin

"Vibe Coding" met AI is als een snelle, slimme kok die heerlijke maaltijden maakt, maar die vaak vergeet om het vlees gaar te koken of gif toe te voegt; het ziet er goed uit en smaakt misschien goed, maar het kan je ziek maken.

De boodschap: We moeten AI's niet blindelings vertrouwen voor veiligheidskritische taken. Er is nog veel werk te doen voordat we kunnen zeggen dat deze robots veilig genoeg zijn om onze digitale huizen te bouwen.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →