SafeRun: Enabling Determinism in LLM Planning for Running
SafeRun is een framework dat deterministische en veilige uitvoeringsplannen garandeert door de flexibele natuurlijke taalinterpretatie van een LLM te ontkoppelen van de strikte beperkingshandhaving van een deterministische solver, waarbij 100% veiligheid naleving wordt bereikt terwijl concurrerende instructie-opvolgingsmogelijkheden behouden blijven.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Het Probleem: De "Creatieve maar Roekeloze" Coach
Stel je voor dat je een zeer slimme, creatieve AI vraagt om je hardloopschema te plannen. Je zegt: "Ik wil 50 kilometer per week rennen gedurende 8 weken, met elke dinsdag een zware training."
De AI is erg goed in het begrijpen van je woorden. Het is als een getalenteerd verhalenverteller die een prachtig, spannend verhaal over hardlopen kan schrijven. De AI is echter ook probabilistisch — het raadt het volgende woord op basis van patronen, niet op basis van strikte wiskunde.
In de wereld van hardlopen is dit gevaarlijk. Als de AI per ongeluk twee zware trainingen achter elkaar plant of je te ver laat rennen in één dag, kun je geblesseerd raken. Het is alsof je een verhalenverteller vraagt om een brug te ontwerpen; ze kunnen er een prachtige brug van maken, maar als ze de wetten van de fysica niet volgen, stort de brug in.
Het paper noemt dit de "determinism gap" (het determinisme-gat). In taken waarbij veiligheid cruciaal is (zoals hardloopplannen), kun je niet vertrouwen op de "beste gok" van de AI. Je hebt 100% zekerheid nodig dat de regels worden nageleefd.
De Oplossing: SafeRun (De "Creatieve Schrijver" + De "Strikte Ingenieur")
De auteurs stellen SafeRun voor, een nieuwe manier om AI te gebruiken die het "creatieve denken" scheidt van de "veiligheidscontrole".
Zie SafeRun als een team van twee personen die aan een project werken:
- De Vertaler (Het LLM): Dit is de AI. Zijn enige taak is om naar je te luisteren en je rommelige, natuurlijke taalverzoeken te vertalen naar een duidelijke, gestructureerde lijst met instructies. De AI kan het plan zelf niet maken. Het schrijft alleen de "boodschappenlijst".
- De Ingenieur (De Deterministische Solver): Dit is een rigide, op wiskunde gebaseerd computerprogramma. Het neemt de boodschappenlijst van de Vertaler en bouwt het daadwerkelijke plan. Het heeft een reeks onbreekbare regels (zoals "geen twee zware runs achter elkaar" of "maximaal 5 kmo per week"). Als het plan niet perfect aan deze regels voldoet, wijst de Ingenieur het af en vraagt de Vertaler om het opnieuw te proberen.
De Analogie:
Stel je voor dat je een op maat gemaakte taart bestelt.
- De Oude Manier (Pure AI): Je vertelt een bakker: "Maak een taart die veilig is om te eten, maar die ook 500 kaarsjes heeft." De bakker probeert te raden wat je bedoelt. Ze kunnen 500 kaarsjes op een piepklein cupcake zetten, waardoor het in brand vliegt (onveilig).
- De SafeRun-manier: Je vertelt een Vertaler (die jouw taal spreekt): "Ik wil een taart met 500 kaarsjes." De Vertaler schrijft een briefje voor de Ingenieur (een robotbakker). De Robotbakker heeft een regel: "Geen taart mag meer dan 10 kaarsjes per inch hebben." De Robot berekent precies hoe groot de taart moet zijn om 500 kaarsjes veilig te kunnen dragen. Als de taart te klein is, zegt de Robot: "Nee, dat is onveilig," en vraagt de Vertaler om de bestelling aan te passen.
Hoe het in de praktijk werkt
Het paper testte dit systeem door een "Running Planning Benchmark" te creëren. Ze verzamelden 100 verschillende verzoeken van echte hardlopers en 10 verschillende hardloopprofielen (van beginners tot experts).
Ze testten SafeRun tegen twee andere methoden:
- Prompt Engineering: De AI simpelweg vriendelijk vragen om de regels te volgen.
- CodeAct: De AI zijn eigen code laten schrijven om het probleem op te lossen (maar zonder een strikte veiligheidsbewaker).
De Resultaten: Veiligheid Eerst
De resultaten waren spectaculair:
- Veiligheidsscore:
- Oude methoden: De AI kreeg het ongeveer 79% van de tijd goed (Prompt Engineering) en 97% van de tijd (CodeAct). Dat betekent dat in 1 op de 5 gevallen of 1 op de 30 gevallen het plan onveilig was.
- SafeRun: 100%. Elk gegenereerd plan was veilig. De "Ingenieur" heeft nooit een slecht plan doorgelaten.
- Instructieopvolging:
- SafeRun maakte niet alleen veilige plannen; het luisterde ook goed naar wat de gebruiker wilde. Het scoorde iets beter dan de andere methoden op het gebied van het daadwerkelijk uitvoeren van wat de gebruiker vroeg (zoals het rennen van het juiste aantal dagen).
Waarom dit belangrijk is (Volgens het Paper)
Het paper betoogt dat voor zaken waarbij fouten fysieke schade kunnen veroorzaken (zoals hardlopen, medicatiedosering of autorijden), we de AI niet kunnen vertrouwen om het juiste antwoord te "raden".
SafeRun bewijst dat je de flexibiliteit van menselijke taal kunt hebben (praten tegen de AI als een coach) terwijl je de strikte veiligheid van een wiskundige formule behoudt. De AI handelt het "wat wil je?" af en de computer handelt het "is dit veilig?" af.
De Beperkingen
De auteurs zijn eerlijk over wat SafeRun nog niet kan:
- Het werkt op dit moment alleen voor hardlopen. De "Ingenieur" is specifiek gebouwd voor hardloopregels.
- Het test alleen verzoeken die oplosbaar zijn. Als je om een onmogelijk plan vraagt (bijv. "Ren 1.000 km per week"), is het systeem ontworpen om haalbare verzoeken af te handelen, en niet noodzakelijkerwijs om over onmogelijke zaken te onderhandelen (hoewel het gebruikers wel waarschuwt).
Samenvatting
SafeRun is als het inhuren van een creatieve vertaler om te praten met een strikte veiligheidsinspecteur. De vertaler begrijpt jouw dromen, en de inspecteur zorgt ervoor dat die dromen de wetten van de fysica niet breken. Het resultaat is een hardloopplan dat zowel gepersonaliseerd als 100% veilig is.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.