← Neueste Arbeiten
💬 NLP

SlotGuard: Stop Oversharing Private Local Context in LLM Agent Transcri

SlotGuard ist ein lokales System zur Transkript-Abgrenzung, das LLM-Agenten durch das Umschreiben sensibler Daten in formaterhaltende, über einen Sitzungsgraphen verknüpfte synthetische Slots sicher vor dem Abfließen privater Kontexte und Zugangsdaten schützt und dadurch eine null Leakage von Zugangsdaten sowie einen nahezu perfekten Aufgabenerfolg ohne die Sprödigkeit bestehender Redaktionsmethoden erreicht.

Ursprüngliche Autoren: Haocheng Xia, Yongjoo Park

Veröffentlicht 2026-07-21
📖 5 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Haocheng Xia, Yongjoo Park

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Stellen Sie sich vor, Sie hätten einen superintelligenten Roboter-Assistenten, der fast alles für Sie erledigen kann: Er kann Dateien auf Ihrem Computer lesen, E-Mails versenden, Code ausführen und sogar mit anderer Software kommunizieren. Um diese Aufgaben zu bewältigen, muss der Roboter Zugriff auf Ihre privaten Informationen haben, wie zum Beispiel Ihre Dateipfade, Ihre E-Mail-Adresse und sogar geheime Passwörter. Aber es gibt einen Haken: Um herauszufinden, was er als Nächstes tun soll, muss der Roboter oft eine Zusammenfassung seiner Arbeit an ein riesiges, cloudbasiertes „Gehirn“ senden – ein großes Sprachmodell, das einem Technologieunternehmen gehört. Diese Zusammenfassung wird als „Transkript“ bezeichnet.

Das Problem ist, dass dieses Transkript wie ein Tagebucheintrag ist, der einem Fremden zugeschickt wird. Wenn der Roboter versehentlich Ihr geheimes Passwort oder Ihre Privatadresse in diesen Tagebucheintrag schreibt, könnte das Cloud-Unternehmen diese Informationen sehen, speichern oder sogar dazu verwenden, um ihre zukünftigen Roboter zu trainieren. Es ist, als würde man einem Freund bitten, beim Backen eines Kuchens zu helfen, aber man müsste ihm gleichzeitig ein Foto seiner Küche schicken, auf dem neben dem Mehl auch noch der Hausschlüssel liegt. Man möchte, dass der Freund die Küche sieht, damit er einem sagen kann, wie man den Teig mischt, aber man möchte definitiv nicht, dass er den Schlüssel sieht. Dieses Paper befasst sich mit der kniffligen Frage, wie man dem Roboter erlaubt, Ihre private Welt zu sehen, ohne dass das Cloud-Gehirn in Ihre Geheimnisse spähen kann.

Hier kommt SlotGuard ins Spiel, ein cleveres neues System, das als „Privacy Bouncer“ (Datenschutz-Türsteher) direkt auf Ihrem Computer fungiert. Stellen Sie sich SlotGuard als einen magischen Übersetzer vor, der zwischen Ihrem Roboter-Assistenten und dem Cloud-Gehirn sitzt. Seine Aufgabe ist es, das Tagebuch des Roboters umzuschreiben, bevor es Ihr Haus verlässt. Anstatt zuzulassen, dass der Roboter Ihr tatsächliches geheimes Passwort aufschreibt (wie SuperSecret123!), ersetzt SlotGuard es durch einen falschen, aber perfekt geformten Platzhalter (wie 🔑-SYNTHETIC-KEY-99).

Der Clou an der Sache ist: Der falsche Platzhalter sieht für das Cloud-Gehirn exakt so aus und fühlt sich auch so an wie das Original. Wenn das echte Passwort eine lange Zeichenfolge aus Buchstaben und Zahlen war, ist es auch der falsche Platzhalter. Wenn der echte Dateipfad /Users/Alice/Secrets/Plan.pdf lautete, könnte der falsche etwa so aussehen: [REPO_ROOT_1]/Secrets/Plan.pdf. Das Cloud-Gehirn kann die Struktur immer noch lesen – es weiß, dass es eine Datei ist, es weiß, dass es ein Geheimnis ist, und es weiß, wie es darüber sprechen soll – aber es hat keine Ahnung, was das eigentliche Geheimnis ist. Es ist, als würde man dem Cloud-Gehirn eine Karte geben, auf der der Schatz mit einem generischen „X“ markiert ist, anstatt mit den echten Koordinaten.

Doch die Magie hört hier nicht auf. Wenn das Cloud-Gehirn Anweisungen zurückschickt, wie zum Beispiel „Öffne diese Datei“, fängt SlotGuard die Nachricht ab, bevor sie Ihren Roboter erreicht. Es prüft seine eigene geheime Liste, stellt fest, dass [REPO_ROOT_1] tatsächlich /Users/Alice/Secrets/Plan.pdf bedeutet, und tauscht das Falsche wieder gegen das Echte aus – und das nur innerhalb Ihres vertrauenswürdigen Computers. Der Roboter öffnet dann die echte Datei, und das Cloud-Gehirn wusste nie, dass der echte Name existierte.

Die Forscher haben dieses System mit einigen ernsthaften Hausaufgaben getestet. Sie erstellten tausende fiktive Szenarien, in denen Roboter versuchten, Aufgaben mit sensiblen Daten zu erledigen, wie etwa das Lesen privater Dokumente oder die Verwendung geheimer Schlüssel. Sie fanden heraus, dass die Roboter ohne SlotGuard fast alles preisgaben – und das in 100 % der Fälle. Selbst einfache „Redaktionsmethoden“, die Geheimnisse einfach durch Wörter wie [PASSWORD] ersetzen, waren eine Katastrophe; sie beeinträchtigten die Arbeitsfähigkeit des Roboters massiv und führten in 97,5 % der Fälle zum Scheitern, weil der Roboter durch die fehlenden Details verwirrt wurde.

SlotGuard hingegen war ein Game-Changer. In ihren Tests konnte die Vollversion des Systems (die einen intelligenten Tracking-Graphen enthält) alle platzierten Zugangsdaten verbergen und alle Leaks von Anmeldedaten verhindern (0,0 % Leakage). Bei strukturellen Daten wie Pfaden und E-Mails entfernte es 100 % der sichtbaren sensiblen Zeichen, mit Ausnahme eines spezifischen Grenzfalls bezüglich Root-besitzender absoluter Pfade, der eine kleine Lücke im aktuellen Prototyp darstellt. Noch besser: Es hat das „Gehirn“ des Roboters nicht blockiert. Die Roboter, die SlotGuard nutzten, waren bei ihren Aufgaben fast so gut wie jene, die die echten Geheimnisse gesehen hatten, wobei sie ihre Erfolgsraten beibehielten. Das System ist zudem unglaublich schnell und benötigt weniger als einen Wimpernschlag (etwa 14 Mikrosekunden), um eine einzelne Konversationsrunde umzuschreiben, sodass es den Ablauf nicht verlangsamt.

Das Paper weist auch darauf hin, was SlotGuard nicht leistet. Es ist kein Gedankenlese-Schild; wenn das Cloud-Gehirn klug genug ist, Ihr Geheimnis allein aus dem Kontext des Gesprächs zu erraten, kann SlotGuard dies nicht verhindern. Es schützt Sie auch nicht, falls Ihr eigener Computer bereits gehackt wurde. Aber für das spezifische Problem, Ihre privaten Daten vor dem Durchsickern in die Cloud-Transkripte zu schützen, bietet SlotGuard eine robuste, schnelle und intelligente Lösung, die Ihre Geheimnisse sicher verwahrt, während Ihr Roboter seine Arbeit verrichten kann.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →