Co-RedTeam: Orchestrated Security Discovery and Exploitation with LLM Agents
Co-RedTeam ist ein sicherheitsbewusstes Multi-Agenten-Framework, das LLMs mit ausführungsorientierter Argumentation, strukturierter Interaktion und Langzeitgedächtnis nutzt, um durch die Spiegelung realer Red-Teaming-Workflows bestehende Baselines bei der automatisierten Entdeckung und Ausnutzung von Schwachstellen signifikant zu übertreffen.
Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen
Stellen Sie sich vor, Sie besitzen ein riesiges, komplexes Haus (einen Software-Codebase) und möchten jeden möglichen Weg finden, auf dem ein Einbrecher eindringen könnte. Traditionell würden Sie ein Team von menschlichen Sicherheitsexperten engagieren, die durch jedes Zimmer gehen, jedes Fenster kontrollieren und versuchen, jedes Schloss zu knacken. Das dauert lange, kostet viel Geld und ist schwer skalierbar.
Das Paper stellt Co-RedTeam vor, ein neues System, das Künstliche Intelligenz (speziell Large Language Models oder „LLMs“) nutzt, um als automatisiertes, superintelligentes Team von Sicherheitsexperten zu fungieren. Anstatt dass nur eine einzige KI rät, was falsch sein könnte, organisiert Co-RedTeam eine Gruppe spezialisierter KI-Agenten, die zusammenarbeiten, genau wie ein echtes menschliches Red-Teaming-Team.
Hier ist die Funktionsweise, unterteilt mit einfachen Analogien:
Das Problem mit alten KI-Sicherheitstools
Frühere Versuche, KI für Hacking einzusetzen, waren wie einem einzelnen Roboter eine Karte zu geben und ihm zu sagen: „Finde die Schwachstelle.“
- Das Problem: Der Roboter rät oft falsch, bleibt stecken oder versucht einzubrechen, ohne tatsächlich zu testen, ob sein Plan funktionierte. Ihm fehlte die „Erdung“ (Grounding) – er konnte nicht sehen, ob seine Ideen in der realen Welt tatsächlich funktionierten. Er vergaß auch, was er aus vorherigen Versuchen gelernt hatte.
Die Co-RedTeam Lösung: Ein spezialisiertes SWAT-Team
Co-RedTeam löst dies, indem es wie ein koordiniertes SWAT-Team agiert und nicht wie ein einsamer Wolf. Es unterteilt die Aufgabe in zwei Hauptphasen, die von einem „Teamleiter“ (dem Orchestrator) verwaltet werden.
Phase 1: Die Detektivarbeit (Vulnerability Discovery)
Bevor versucht wird einzubrechen, muss das Team wissen, wo es suchen muss.
- Der Analyst-Agent: Dieser Agent ist wie ein Detektiv mit einer Lupe. Er liest nicht nur den Code; er nutzt spezielle Werkzeuge, um das gesamte „Haus“ (die Codebase) zu durchsuchen, die Baupläne (Dateistruktur) zu betrachten und die Regeln (Sicherheitsdokumentationen wie CWE und OWASP) zu prüfen. Er sucht nach Hinweisen, die darauf hindeuten, dass ein Schloss schwach sein könnte.
- Der Critic-Agent: Dieser Agent ist wie ein skeptischer Editor. Wenn der Analyst eine potenzielle Schwachstelle findet, sagt der Critic: „Bist du sicher? Zeig mir die Beweise.“ Wenn die Beweise schwach sind, schickt der Critic den Analysten zurück, um genauer hinzusehen. Dieses Geben und Nehmen stellt sicher, dass keine Zeit mit Fehlalarmen verschwendet wird.
Phase 2: Der Einbruch (Iterative Exploitation)
Sobald eine potenzielle Schwachstelle gefunden wurde, versucht das Team tatsächlich einzubrechen, um zu beweisen, dass sie existiert.
- Der Planner-Agent: Dieser Agent ist der Stratege. Anstatt blind Steine gegen die Wand zu werfen, schreibt er einen Schritt-für-Schritt-Plan: „Schritt 1: Fenster öffnen. Schritt 2: Leiter hochklettern.“
- Der Execution-Agent: Dies ist der „Muskel“, der den Plan innerhalb einer sicheren, isolierten Sandbox (einer digitalen Simulation des Ziels) tatsächlich ausführt. Er führt den Code oder die Befehle aus, um zu sehen, ob der Einbruch funktioniert.
- Der Evaluation-Agent: Dieser Agent beobachtet das Ergebnis. Wurde das Fenster geöffnet? Ging der Alarm los? Er sagt dem Planner: „Das hat nicht funktioniert, weil das Fenster von innen verriegelt war.“
- Die Schleife (The Loop): Der Planner hört dieses Feedback, aktualisiert den Plan („Okay, versuche die Hintertür stattdessen“) und das Team versucht es erneut. Sie verfeinern den Plan immer wieder, bis sie erfolgreich eingebrochen sind oder beweisen können, dass es unmöglich ist.
Die Geheimwaffe: Das „Experience Notebook“ (Langzeitgedächtnis)
Eine der größten Innovationen von Co-RedTeam ist sein Langzeitgedächtnis.
- Die Analogie: Stellen Sie sich einen menschlichen Experten vor, der nach der Lösung eines Falls eine Notiz in ein Tagebuch schreibt: „Merke dir: Wenn die Tür verschlossen ist, versuche es mit dem Schlüsselloch im Briefschlitz, nicht am Griff.“
- Wie es funktioniert: Co-RedTeam speichert drei Arten von Notizen:
- Muster: „Diese Art von Code weist normalerweise diese spezifische Schwäche auf.“
- Strategien: „Wenn man mit dieser Art von System konfrontiert wird, beginnt man damit, die Konfigurationsdateien zu prüfen.“
- Technische Tricks: „Dieser spezifische Befehl hat funktioniert, um diese Firewall zu umgehen.“
- Das Ergebnis: Während das System an immer mehr Aufgaben arbeitet, wird es klüger. Es beginnt nicht jedes Mal bei Null; es lernt aus seinen vergangenen Erfolgen und Misserfolgen, was es schneller und effektiver macht, neue Schwachstellen zu finden.
Was sie herausgefunden haben (Die Ergebnisse)
Die Forscher haben Co-RedTeam bei mehreren schwierigen Cybersicherheits-Herausforderungen (wie CyBench und BountyBench) getestet.
- Erfolgsrate: Das System hat erfolgreich Schwachstellen in über 60 % der Fälle gefunden und ausgenutzt, in denen es getestet wurde.
- Verbesserung: Es war signifikant besser als andere KI-Methoden (einige von denen Erfolgsraten von unter 10 % aufwiesen).
- Warum es funktionierte: Das Paper zeigte, dass das System viel schlechter wird, wenn man irgendeinen Teil des Teams entfernt (wie den Critic, den Planner oder das Gedächtnis). Die Magie entsteht dadurch, dass all diese Teile in einer Schleife aus Planung, Testen und Lernen zusammenarbeiten.
Zusammenfassung
Co-RedTeam ist wie ein Upgrade von einem einzelnen, verwirrten Roboter, der versucht, ein System zu hacken, hin zu einem hochorganisierten, selbstverbessernden Sicherheitsteam. Es nutzt einen Teamleiter zur Koordination von Spezialisten, überprüft seine eigene Arbeit, lernt aus jedem Versuch und nutzt reale Tests, um seine Funde zu beweisen, was es bei der Suche nach Software-Schwachstellen weitaus effektiver macht als bisherige KI-Tools.
Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?
Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.