← Neueste Arbeiten
💬 NLP

SafeRun: Enabling Determinism in LLM Planning for Running

SafeRun ist ein Framework, das deterministische und sichere Ausführungspläne gewährleistet, indem es die flexible natürliche Sprachinterpretation eines LLMs von der strikten Constraint-Durchsetzung eines deterministischen Solvers entkoppelt und so eine 100%ige Sicherheitskonformität bei gleichbleibend wettbewerbsfähigen Fähigkeiten zur Befolgung von Anweisungen erreicht.

Ursprüngliche Autoren: Meilin Chen, Zepeng Zhai, Jiaxuan Zhao, Yuan Lu

Veröffentlicht 2026-06-09
📖 5 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Meilin Chen, Zepeng Zhai, Jiaxuan Zhao, Yuan Lu

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Das Problem: Der „kreative, aber leichtsinnige“ Coach

Stellen Sie sich vor, Sie bitten eine sehr intelligente, kreative KI, Ihren Laufplan zu erstellen. Sie sagen: „Ich möchte acht Wochen lang 50 Kilometer pro Woche laufen, mit einem harten Training jeden Dienstag.“

Die KI ist großartig darin, Ihre Worte zu verstehen. Sie ist wie ein talentierter Geschichtenerzähler, der eine wunderschöne, spannende Geschichte über das Laufen schreiben kann. Die KI ist jedoch auch probabilistisch – sie rät das nächste Wort basenteils auf Mustern, nicht auf strenger Mathematik.

In der Welt des Laufens ist das gefährlich. Wenn die KI versehentlich zwei harte Einheiten direkt hintereinander plant oder Sie dazu bringt, an einem Tag zu weit zu laufen, könnten Sie sich verletzen. Es ist, als würde man einen Geschichtenerzähler bitten, eine Brücke zu entwerfen; er wird sie vielleicht wunderschön aussehen lassen, aber wenn er nicht den Gesetzen der Physik folgt, stürzt die Brücke ein.

Das Paper nennt dies die „Determinismus-Lücke“ (determinism gap). Bei sicherheitskritischen Aufgaben (wie Laufplänen) können Sie sich nicht auf die „beste Vermutung“ der KI verlassen. Sie benötigen 100 % Gewissheit, dass die Regeln eingehalten werden.

Die Lösung: SafeRun (Der „kreative Schreiber“ + Der „strenge Ingenieur“)

Die Autoren schlagen SafeRun vor, eine neue Art, KI zu nutzen, bei der das „kreative Denken“ von der „Sicherheitsprüfung“ getrennt wird.

Stellen Sie sich SafeRun als ein Zwei-Personen-Team vor, das an einem Projekt arbeitet:

  1. Der Übersetzer (Das LLM): Dies ist die KI. Ihre einzige Aufgabe ist es, Ihnen zuzuhören und Ihre unordentlichen Anfragen in natürlicher Sprache in eine klare, strukturierte Liste von Anweisungen zu übersetzen. Sie darf den Plan nicht selbst erstellen. Sie schreibt lediglich die „Einkaufsliste“.
  2. Der Ingenieur (Der deterministische Solver): Dies ist ein starres, mathematisches Computerprogramm. Es nimmt die Einkaufsliste vom Übersetzer und erstellt den eigentlichen Plan. Es besitzt einen Satz von unverrückbaren Regeln (wie „keine zwei harten Läufe hintereinander“ oder „maximal 50 km pro Woche“). Wenn der Plan diese Regeln nicht perfekt erfüllt, lehnt der Ingenieur ihn ab und bittet den Übersetzer, es erneut zu versuchen.

Die Analogie:
Stellen Sie sich vor, Sie bestellen eine maßgeschneiderte Torte.

  • Der alte Weg (Reine KI): Sie sagen einem Bäcker: „Back mir eine Torte, die sicher zu essen ist, aber auch 500 Kerzen hat.“ Der Bäcker versucht zu erraten, was Sie meinen. Er könnte 500 Kerzen auf einen winzigen Cupcake setzen, was dazu führt, dass dieser Feuer fängt (unsicher).
  • Der SafeRun-Weg: Sie sagen einem Übersetzer (der Ihre Sprache spricht): „Ich möchte eine Torte mit 500 Kerzen.“ Der Übersetzer schreibt eine Notiz für den Ingenieur (einen Roboter-Bäcker). Der Roboter-Bäcker hat eine Regel: „Keine Torte darf mehr als 10 Kerzen pro Zoll haben.“ Der Roboter berechnet exakt, wie groß die Torte sein muss, um 500 Kerzen sicher zu halten. Wenn die Torte zu klein ist, sagt der Roboter: „Nö, das ist unsicher“, und bittet den Übersetzer, die Bestellung anzupassen.

Wie es in der Praxis funktioniert

Das Paper testete dieses System durch die Erstellung eines „Running Planning Benchmark“. Sie sammelten 100 verschiedene Anfragen von echten Läufern und 10 verschiedene Läuferprofile (vom Anfänger bis zum Experten).

Sie testeten SafeRun gegen zwei andere Methoden:

  1. Prompt Engineering: Man bittet die KI einfach höflich, die Regeln zu befolgen.
  2. CodeAct: Man lässt die KI ihren eigenen Code schreiben, um das Problem zu lösen (aber ohne eine strikte Sicherheitskontrolle).

Die Ergebnisse: Sicherheit geht vor

Die Ergebnisse waren dramatisch:

  • Sicherheitswert (Safety Score):
    • Alte Methoden: Die KI hatte in etwa 79 % der Fälle recht (Prompt Engineering) und in 9_7 % der Fälle (CodeAct). Das bedeutet, in 1 von 5 oder 1 von 30 Fällen war der Plan unsicher.
    • SafeRun: 100 %. Jeder einzelne generierte Plan war sicher. Der „Ingenieur“ hat nie einen schlechten Plan durchgelassen.
  • Anweisungsbefolgung (Instruction Following):
    • SafeRun erstellte nicht nur sichere Pläne, sondern hörte auch gut auf das, was der Nutzer wollte. Es schnitt etwas besser ab als die anderen Methoden darin, tatsächlich das zu tun, was der Nutzer verlangte (wie z. B. die richtige Anzahl an Tagen zu laufen).

Warum das wichtig ist (Laut dem Paper)

Das Paper argumentiert, dass wir bei Dingen, bei denen Fehler körperlichen Schaden verursachen können (wie beim Laufen, bei der Medikamentendosierung oder beim Autofahren), der KI nicht vertrauen können, die richtige Antwort zu „erraten“.

SafeRun beweist, dass man die Flexibilität der menschlichen Sprache (mit der KI wie mit einem Coach zu sprechen) mit der starren Sicherheit einer mathematischen Formel kombinieren kann. Die KI kümmert sich um das „Was wollen Sie?“, und der Computer kümmert sich um das „Ist das sicher?“.

Die Einschränkungen

Die Autoren sind ehrlich darüber, was SafeRun noch nicht kann:

  • Es funktioniert derzeit nur für das Laufen. Der „Ingenieur“ wurde speziell für Laufregeln entwickelt.
  • Es werden nur Anfragen getestet, die auch lösbar sind. Wenn Sie einen unmöglichen Plan anfordern (z. B. „Laufe 1.000 km pro Woche“), ist das System darauf ausgelegt, machbare Anfragen zu handhaben, und nicht unbedingt darauf, über Unmögliches zu verhandeln (obwohl es den Nutzer darauf hinweist).

Zusammenfassung

SafeRun ist wie das Anheuern eines kreativen Übersetzers, um mit einem strengen Sicherheitsinspektor zu sprechen. Der Übersetzer versteht Ihre Träume, und der Inspektor stellt sicher, dass diese Träume nicht die Gesetze der Physik brechen. Das Ergebnis ist ein Laufplan, der sowohl personalisiert als auch zu 100 % sicher ist.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →