← Neueste Arbeiten
💬 NLP

Is Vibe Coding Safe? Benchmarking Vulnerability of Agent-Generated Code in Real-World Tasks

Die Studie stellt fest, dass beim „Vibe Coding" mit KI-Agenten zwar häufig funktionale Lösungen entstehen, diese jedoch in realen Aufgaben überwiegend unsicher sind und selbst gezielte Sicherheitsmaßnahmen dieses Risiko nicht wirksam mindern können.

Ursprüngliche Autoren: Songwen Zhao, Danqing Wang, Kexun Zhang, Jiaxuan Luo, Zhuo Li, Lei Li

Veröffentlicht 2026-02-18
📖 4 Min. Lesezeit☕ Kaffeepausen-Lektüre

Ursprüngliche Autoren: Songwen Zhao, Danqing Wang, Kexun Zhang, Jiaxuan Luo, Zhuo Li, Lei Li

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Stell dir vor, du hast einen extrem talentierten, aber noch sehr jungen Lehrling namens „KI-Agent". Dieser Lehrling kann nicht nur Texte schreiben, sondern ganze Software-Projekte programmieren. Das neue Programmier-Paradies, das die Autoren „Vibe Coding" nennen, funktioniert so: Du sagst dem Lehrling einfach nur, was du brauchst (z. B. „Baue eine sichere Tür für mein Haus"), und er baut sie, ohne dass du ihm jeden einzelnen Schritt zeigen musst.

Die große Frage, die sich die Forscher in diesem Papier stellen, ist: Ist das, was dieser Lehrling baut, wirklich sicher? Oder baut er vielleicht eine Tür, die von innen verschlossen aussieht, aber einen versteckten Hintereingang hat, durch den jeder eindringen kann?

Hier ist die Zusammenfassung der Studie „SUSVIBES" in einfachen Worten:

1. Das Experiment: Ein Test für den Lehrling

Die Forscher haben einen riesigen Test entwickelt, den sie SUSVIBES nennen.

  • Die Aufgabe: Sie haben 200 echte Programmieraufgaben aus der realen Welt gesammelt (z. B. aus großen Software-Projekten wie Django oder Buildbot).
  • Der Trick: Bei jeder Aufgabe gab es früher ein echtes Sicherheitsleck (ein „Loch" im System), das von Menschen repariert wurde. Die Forscher haben dieses Loch wieder „eingeflickt" (also den Code wieder unsicher gemacht) und dem KI-Lehrling gesagt: „Repariere das Loch und füge eine neue Funktion hinzu."
  • Das Ziel: Sie wollten sehen, ob der KI-Lehrling die neue Funktion baut, aber dabei das alte Loch wieder vergisst oder sogar ein neues Loch hineingebaut.

2. Die erschreckenden Ergebnisse

Das Ergebnis ist beunruhigend, fast wie eine Warnung vor einem Baumeister, der zwar ein schönes Haus baut, aber die Fundamente vergisst:

  • Funktioniert es? Ja, oft. Die KIs konnten in etwa 60 % der Fälle die Aufgabe so lösen, dass die Software technisch funktionierte (die Tür schloss sich, das Licht ging an).
  • Ist es sicher? Nein, fast nie. Von den Lösungen, die funktionierten, waren über 80 % unsicher.
    • Die Analogie: Stell dir vor, du bestellst einen neuen Safe. Der Lehrling baut einen, der sich perfekt schließt und einen schönen Schlüssel hat (funktionell korrekt). Aber er vergisst, dass er das Schloss mit einem Stück Klebeband verklebt hat, das jeder von außen öffnen kann (Sicherheitslücke).

Selbst die besten KI-Modelle (wie Claude 4 Sonnet) und die fortschrittlichsten Agenten-Systeme scheiterten hier kläglich. Sie waren gut darin, Code zu schreiben, aber schlecht darin, zu denken: „Was könnte ein Hacker hier ausnutzen?"

3. Warum helfen einfache Tipps nicht?

Die Forscher dachten sich: „Vielleicht müssen wir dem Lehrling nur sagen: Hey, sei vorsichtig!"
Sie probierten verschiedene Methoden aus:

  • Der generische Hinweis: „Bitte achte auf Sicherheit."
  • Die Selbstprüfung: „Überlege dir zuerst, welche Fehlerarten (CWEs) hier auftreten könnten."
  • Der direkte Hinweis: „Hier ist genau das Loch, das du vermeiden musst."

Das Ergebnis: Es half kaum. Im Gegenteil! Wenn man den Lehrling zu sehr auf Sicherheit fixierte, wurde der Code oft gar nicht mehr richtig. Er baute dann zwar eine sehr sichere, aber kaputte Tür, die sich gar nicht mehr öffnen ließ.

  • Die Metapher: Es ist wie bei einem Koch, dem man sagt: „Achte auf Hygiene!" Wenn man ihm aber zu viel Druck macht, vergisst er, das Essen zu salzen oder zu kochen. Das Essen ist dann hygienisch, aber ungenießbar.

4. Was bedeutet das für uns?

Die Studie zeigt, dass wir uns noch nicht blind auf diese neue Art des Programmierens („Vibe Coding") verlassen können, besonders nicht in Bereichen, bei denen Sicherheit lebenswichtig ist (wie Bankdaten, Passwörter oder medizinische Geräte).

  • Das Problem: Die KIs sind wie sehr schnelle, aber ungeduldige Schüler. Sie wollen die Aufgabe schnell erledigen und übersehen dabei die feinen Details, die ein Hacker ausnutzen könnte.
  • Die Gefahr: Wenn Firmen diese KI-Agenten einfach so in ihre Systeme einsetzen, ohne dass ein menschlicher Experte den Code genau prüft, könnten sie versehentlich riesige Sicherheitslücken in ihre eigenen Systeme bauen.

Fazit

„Vibe Coding" ist ein mächtiges Werkzeug, das die Produktivität steigern kann. Aber die Studie warnt: Vertraue nicht darauf, dass die KI automatisch sicher programmiert.

Es ist wie beim Bauen eines Hauses: Du kannst dem Architekten (der KI) sagen, er soll ein Haus bauen, aber du musst selbst (oder ein menschlicher Sicherheitsingenieur) prüfen, ob die Fenster wirklich gegen Einbrüche gesichert sind. Die KI baut gerne, aber sie vergisst oft, das Schloss zu drehen.

Die Botschaft: Solange wir keine besseren Methoden finden, um KIs sicher zu machen, sollten wir diese Technologie in sensiblen Bereichen nur mit großer Vorsicht und strenger menschlicher Kontrolle einsetzen.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →