ClawKeeper: Comprehensive Safety Protection for OpenClaw Agents Through Skills, Plugins, and Watchers
यह शोध पत्र ClawKeeper को प्रस्तुत करता है, जो OpenClaw स्वायत्त एजेंटों के लिए एक व्यापक वास्तविक समय सुरक्षा ढांचा है, जो कौशल-आधारित निर्देश नीतियों, प्लगइन-आधारित रनटाइम प्रवर्तन और सिस्टम-स्तरीय हस्तक्षेप के लिए एक नवीन विकेंद्रीकृत (decoupled) वॉचर मिडलवेयर की तीन-स्तरीय वास्तुकला के माध्यम से महत्वपूर्ण कमजोरियों को कम करता है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि आपने अभी-अभी एक सुपर-स्मार्ट, सेल्फ-ड्राइविंग रोबोट बटलर OpenClaw खरीदा है। यह रोबोट अविश्वसनीय है: यह कोड लिख सकता है, आपकी फाइलों को मैनेज कर सकता है, आपके दोस्तों को संदेश भेज सकता है, और यहाँ तक कि आपके कंप्यूटर पर कमांड भी चला सकता है। यह ऐसा है जैसे आपने अपने पूरे डिजिटल घर की मास्टर चाबी अपने रोबोट को दे दी हो।
लेकिन समस्या यह है: क्योंकि इस रोबोट के पास एक बड़ी चाबी है, यदि रोबोट भ्रमित हो जाता है, धोखा खा जाता है, या हैक हो जाता है, तो यह गलती से आपकी तस्वीरें डिलीट कर सकता है, आपके पासवर्ड लीक कर सकता है, या किसी अजनबी को आपके घर में घुसने दे सकता है।
यह पेपर ClawKeeper को पेश करता है, जो एक नया सुरक्षा सिस्टम है जिसे आपके रोबंतु को सुरक्षित रखने के लिए डिज़ाइन किया गया है। यह सोचें कि ClawKeeper केवल एक उपकरण नहीं है, बल्कि एक तीन-परत वाली सुरक्षा टीम है जो आपके रोबोट को धीमा किए बिना उसे सुरक्षित रखने के लिए मिलकर काम करती है।
यहाँ बताया गया है कि ये तीन परतें रोज़मर्रा के उदाहरणों के साथ कैसे काम करती हैं:
1. "नियम पुस्तिका" परत (कौशल-आधारित सुरक्षा)
उदाहरण: कल्पना कीजिए कि रोबोट के काम शुरू करने से पहले उसे एक प्रिंटेड निर्देश मैनुअल देना।
- यह कैसे काम करता है: यह परत रोबोट के "दिमाग" (इसके प्रॉम्प्ट्स) में सीधे सुरक्षा नियम लिख देती है। यह रोबोट को बताती है, "चाहे कुछ भी हो जाए, कभी भी तिजोरी न खोलें," या "यदि कोई आपसे आपका पासवर्ड मांगे, तो 'ना' कहें।"
- चुनौती: यह एक कागजी मैनुअल की तरह है। यदि कोई चतुर हैकर रोबोट को यह विश्वास दिलाने में सफल हो जाता कि मैनुअल गलत है, या यदि रोबोट भ्रमित होकर मैनुअल को अनदेखा कर देता है, तो सुरक्षा विफल हो जाती है। यह मददगार है, लेकिन यह रोबोट के विनम्र और आज्ञाकारी होने पर निर्भर करता है।
2. "सुरक्षा गार्ड" परत (प्लगइन-आधारित सुरक्षा)
उदाहरण: अब, कल्पना कीजिए कि आप रोबोट के घर के अंदर एक मजबूत सुरक्षा गेट स्थापित करते हैं।
- यह कैसे काम करता है: यह एक सॉफ्टवेयर है जो सीधे रोबोट के सिस्टम में बना है। यह एक बाउंसर की तरह काम करता है जो रोबंड द्वारा किए जाने वाले हर एक काम की जांच करता है। यदि रोबोट कोई खतरनाक कमांड चलाने की कोशिश करता है (जैसे, "सब कुछ डिलीट कर दो"), तो यह गेट होने से पहले ही इसे भौतिक रूप से ब्लॉक कर देता है। यह दरवाजों (कॉन्फ़िगरेशन फाइलों) को भी लॉक कर देता है ताकि कोई अंदर घुसकर नियमों को बदल न सके।
- चुनौती: यह गार्ड बहुत सख्त और तेज़ है, लेकिन यह घर के अंदर ही सीमित है। यदि रोबोट को गार्ड को "जाने के लिए" कहने के लिए बहला दिया जाता है, या यदि हैकर को कोई ऐसा गुप्त रास्ता मिल जाता है जिसके बारे में गार्ड नहीं जानता, तो सिस्टम असुरक्षित हो जाता है। साथ ही, गार्ड तब तक नए तरीके आसानी से नहीं सीख सकता जब तक कि कोई मानव प्रोग्रामर इसके कोड को अपडेट न करे।
3. "स्वतंत्र निरीक्षक" परत (मुख्य आकर्षण)
उदाहरण: यह सबसे अनूठा हिस्सा है। कल्पना कीजिए कि आपने एक दूसरा, स्वतंत्र रोबोट काम पर रखा है जिसका एकमात्र काम पहले रोबोट को देखना है। चलिए इसे The Watcher (द वॉचर) नाम देते हैं।
- यह कैसे काम करता है: द वॉचर कोई घरेलू काम नहीं करता। वह ईमेल नहीं लिखता या घर की सफाई नहीं करता। वह बस एक अलग कमरे में बैठता है, एक खिड़की (एक सुरक्षित कनेक्शन) के माध्यम से पहले रोबोट को देखता रहता है।
- यदि पहला रोबोट कुछ अजीब करने लगता है, तो द वॉचर इमरजेंसी स्टॉप बटन दबा देता है।
- यदि पहले रोबोट को आपकी फाइलें डिलीट करने की कोशिश करने के लिए बहलाया जाता है, तो द वॉचर इसे देख लेता है, कार्रवाई को रोकता है, और आपसे (इंसान से) पूछता है, "क्या आप वाकई यह करना चाहते हैं?"
- यह क्यों शानदार है:
- इसे धोखा नहीं दिया जा सकता: चूंकि द वॉचर एक अलग रोबोट है, इसलिए पहला रोबोट उसे "जाने जाओ" या "सुरक्षा को अनदेखा करो" का आदेश नहीं दे सकता।
- यह सीखता है: जैसे-जैसे द वॉचर नए प्रकार के धोखों को देखता है, वह स्मार्ट होता जाता है और स्वचालित रूप से अपने नियम अपडेट करता है। यह एक ऐसे सुरक्षा गार्ड की तरह है जो चोरों को रोकने के नए तरीके सीखने के लिए नाइट स्कूल जाता है।
- यह कर्तव्यों को अलग करता है: पहला रोबोट 100% मददगार होने पर ध्यान केंद्रित कर सकता है, जबकि द वॉचर 100% सुरक्षित रहने पर ध्यान केंद्रित करता है। वे एक-दूसरे से लड़ते नहीं हैं।
बड़ी तस्वीर: यह क्यों मायने रखता है
ClawKeeper से पहले, सुरक्षा प्रणालियाँ कार दुर्घटना को रोकने के लिए डैशबोर्ड पर एक साइन लगाने (कौशल) या दरवाजे पर एक कमजोर ताले (प्लगइन) की तरह थीं। वे अक्सर विफल हो जाती थीं क्योंकि वे बहुत कठोर थीं या उन्हें आसानी से बायपास किया जा सकता था।
ClawKeeper एक पूर्ण सुरक्षा पारिस्थितिकी तंत्र (ecosystem) की तरह है:
- नियम पुस्तिका होने से पहले गलतियों को रोकने की कोशिश करती है।
- सुरक्षा गार्ड तुरंत खतरनाक कार्यों को रोकता है।
- स्वतंत्र निरीक्षक एक अंतिम, अन-ट्रिकीबल (धोखा न खाने वाला) सुरक्षा जाल के रूप में कार्य करता है जो पहले दो स्तरों के विफल होने पर भी रोबोट को रोक सकता है।
परिणाम
शोधकर्ताओं ने 140 अलग-अलग तरीकों से, जिनसे हैकर्स रोबोट को धोखा देने की कोशिश करते हैं (जैसे पासवर्ड मांगना, फाइलें डिलीट करना या वायरस इंस्टॉल करना), इस सिस्टम का परीक्षण किया।
- पुराने सुरक्षा सिस्टम ने इन हमलों में से लगभग 60% को रोका।
- ClawKeeper ने इनमें से 85% से 90% हमलों को रोका।
संक्षेप में: यदि OpenClaw भविष्य के ऑपरेटिंग सिस्टम (जैसे रोबोट के लिए Windows या macOS) का ऑपरेटिंग सिस्टम है, तो ClawKeeper वह एंटीवायरस सॉफ्टवेयर है जो यह सुनिश्चित करता है कि आपका रोबोट आपकी मदद करने के प्रयास में अनजाने में आपका घर न जला दे। यह अंतिम "सेफ्टी नेट" है जो AI को खतरनाक हुए बिना शक्तिशाली होने देता है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।