← Neueste Arbeiten
💻 computer science

TEAR: Temporal-aware Automated Red-teaming for Text-to-Video Models

Die Arbeit stellt TEAR vor, einen temporalbewussten automatisierten Red-Teaming-Rahmenwerk, das durch die Ausnutzung dynamischer zeitlicher Sequenzen Sicherheitsrisiken in Text-zu-Video-Modellen aufdeckt und dabei die Erfolgsquote von Angriffen im Vergleich zu bisherigen Methoden von 57 % auf über 80 % steigert.

Ursprüngliche Autoren: Jiaming He, Guanyu Hou, Hongwei Li, Zhicong Huang, Kangjie Chen, Yi Yu, Wenbo Jiang, Guowen Xu, Tianwei Zhang

Veröffentlicht 2026-03-12
📖 4 Min. Lesezeit☕ Kaffeepausen-Lektüre

Ursprüngliche Autoren: Jiaming He, Guanyu Hou, Hongwei Li, Zhicong Huang, Kangjie Chen, Yi Yu, Wenbo Jiang, Guowen Xu, Tianwei Zhang

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Das Problem: Der unsichtbare Trick im Video-Generator

Stell dir vor, du hast einen magischen Koch, der aus reinen Textbeschreibungen Videos kocht. Wenn du sagst „Ein Mann isst einen Apfel", backt er dir ein tolles Video davon. Das ist toll!

Aber dieser magische Koch hat ein Problem: Er ist so gut darin, Dinge zu verbinden, dass man ihn austricksen kann. Stell dir vor, du sagst ihm nicht: „Mach ein Video, in dem jemand giftig wird." Das würde er sofort blockieren.

Stattdessen sagst du ihm:

  1. „Ein Mann trinkt eine klare Flüssigkeit." (Klingt harmlos, oder?)
  2. „Zwei Sekunden später kippt er langsam nach hinten." (Immer noch okay.)
  3. „Dann zuckt sein Körper rhythmisch." (Vielleicht ein bisschen seltsam, aber harmlos.)
  4. „Und plötzlich spritzt Sahne aus seinem Mund." (Komisch, aber kein Verbot.)

Für den Computer sind das vier harmlose Sätze. Aber wenn er sie in dieser Reihenfolge zu einem Video zusammenfügt, sieht das Ergebnis aus wie ein Mann, der sich das Leben nimmt. Das ist das Problem: Die Gefahr liegt nicht in einem einzelnen Satz, sondern in der Zeitabfolge der Ereignisse.

Die Lösung: TEAR (Der „Zeit-Entlarver")

Die Forscher haben ein neues Werkzeug namens TEAR entwickelt. Man kann sich TEAR wie einen professionellen Sicherheitsprüfer oder einen Schachgroßmeister vorstellen, der speziell trainiert wurde, um diese zeitlichen Tricks zu finden.

Hier ist, wie TEAR funktioniert, in drei Schritten:

1. Der Trick-Rezeptur-Entwickler (Der Generator)

Stell dir TEARs Generator wie einen Schauspieler vor, der lernt, wie man eine Szene spielt, ohne dass der Regisseur (der Sicherheitsfilter) merkt, dass es eine gefährliche Szene ist.

  • Der erste Schritt: Er lernt aus alten Beispielen, wie man harmlose Sätze baut, die aber im Kopf des Zuschauers eine gefährliche Geschichte ergeben.
  • Der zweite Schritt (Das Genie): TEAR nutzt einen cleveren Trick namens „Online-Lernen". Er probiert Sätze aus, schaut sich das Ergebnis-Video an und fragt sich: „Hat der Sicherheitsfilter das gesehen? Nein? Gut! War das Video gefährlich? Ja? Perfekt!"
  • Er lernt also ständig dazu, wie man die Zeit nutzt, um die Sicherheitswächter zu täuschen. Er weiß: „Wenn ich die Gefahr in kleine, harmlose Häppchen über die Zeit verteile, sieht niemand das Gift."

2. Der Feinschleifer (Das Verfeinerungs-Modell)

Manchmal ist der erste Versuch noch nicht perfekt. Vielleicht ist der Satz zu klobig oder das Video wird nicht ganz so gefährlich wie geplant.
Hier kommt der Feinschleifer ins Spiel. Er ist wie ein Regisseur, der sich das Video und den Text ansieht und sagt: „Hey, mach den Satz noch etwas natürlicher" oder „Ändere die Reihenfolge der Bilder, damit es noch klarer wird." Er verbessert den Trick immer wieder, bis er unsichtbar für die Filter, aber tödlich für die Sicherheit ist.

3. Der Test (Die Prüfung)

TEAR testet diese Tricks an verschiedenen „magischen Köchen" (den Video-KI-Modellen), sowohl an kostenlosen Open-Source-Versionen als auch an teuren kommerziellen Diensten.

Was haben sie herausgefunden?

Die Ergebnisse sind erschreckend, aber wichtig:

  • TEAR ist extrem erfolgreich: Während alte Methoden nur in etwa 57 % der Fälle einen Sicherheitsfehler fanden, schafft TEAR über 80 %. Das ist ein riesiger Sprung.
  • Die Filter sind blind für Zeit: Die aktuellen Sicherheitsfilter schauen sich nur den Text an (und sind da gut) oder einzelne Bilder. Sie verstehen nicht, wie eine harmlose Geschichte über die Zeit hinweg zu einer Katastrophe werden kann.
  • Der Trick funktioniert überall: Wenn TEAR einen Trick für ein KI-Modell findet, funktioniert er oft auch bei ganz anderen Modellen. Das bedeutet, dass alle diese KI-Video-Generatoren das gleiche fundamentale Sicherheitsproblem haben.

Warum ist das wichtig?

Stell dir vor, TEAR ist wie ein Feuerwehr-Inspektor, der vor dem Eröffnungstag eines neuen Gebäudes kommt. Er findet nicht nur, wo das Feuer ist, sondern zeigt auch, wie man es versteckt anzünden könnte, damit der Rauchmelder es nicht sieht.

Ohne TEAR würden die Entwickler denken: „Unsere KI ist sicher, weil sie keine direkten Befehle wie 'Mord' akzeptiert." TEAR zeigt ihnen jedoch: „Nein, eure KI ist unsicher, weil sie nicht versteht, dass eine harmlose Geschichte in Zeitlupe eine Katastrophe sein kann."

Fazit: TEAR ist ein Werkzeug, um die KI-Entwickler zu zwingen, ihre Sicherheitsnetze zu verbessern, bevor die Technologie in die Hände von böswilligen Nutzern gelangt. Es ist wie ein Spiegel, der zeigt, wo die Risse in der Wand sind, bevor das Haus einstürzt.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →