SAFETY SENTRY: Context-Aware Human Intervention via EXECUTE-ASK-REFUSE Routing
यह शोध पत्र "सेफ्टी सेंट्री" (Safety Sentry) को प्रस्तुत करता है, जो एक हल्का गार्ड मॉडल है जो सुरक्षा और उपयोगकर्ता स्वायत्तता के बीच संतुलन बनाने के लिए एक संदर्भ-जागरूक, प्रति-इन्स्टेंस तीन-तरफा रूटिंग सिस्टम (EXECUTE, ASK, REFUSE) को लागू करके बाइनरी सुरक्षा जांच में सुधार करता है, साथ ही एक एकल डिकोडिंग थ्रेशोल्ड के माध्यम से समायोज्य जोखिम सहनशीलता की अनुमति देता है।