AgentBound: Verifiable Behavioral Governance for Autonomous AI Agents
AgentBound एक रनटाइम गवर्नेंस फ्रेमवर्क है जो डेलिगेटेड ऑथोराइजेशन, ओनर-साइंड कॉन्स्टिट्यूशंस और साइट कॉन्ट्रैक्ट्स के विरुद्ध प्रस्तावित कार्यों का मूल्यांकन करके स्वायत्त एआई एजेंटों के लिए सत्यापन योग्य व्यवहारिक निगरानी सुनिश्चित करता है ताकि क्रिप्टोग्राफिक रूप से ऑडिट करने योग्य रसीदें उत्पन्न की जा सकें जो स्वतंत्र सत्यापन और जवाबदेही को सक्षम बनाती हैं।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि आपने अपने व्यवसाय को चलाने के लिए एक बहुत ही बुद्धिमान, अत्यधिक सक्षम रोबोट सहायक को काम पर रखा है। आप उसे इमारत में प्रवेश करने के लिए एक कीकार्ड (पहचान/Identity) और उन कमरों की एक सूची देते हैं जिनमें वह जा सकता है (प्राधिकरण/Authorization)।
समस्या:
कीकार्ड और कमरों की सूची होने के बावजूद, रोबोट कुछ मूर्खतापूर्ण या खतरनाक काम कर सकता है। उदाहरण के लिए, उसे "फाइनेंस रूम" में जाने और "रिफंड मशीन" का उपयोग करने की अनुमति हो सकती है, लेकिन वह किसी अजीब संदेश से भ्रमित होकर रात के 3 बजे किसी अजनबी को दस लाख रुपये रिफंड करने का निर्णय ले सकता है। रोबोट ने इस नियम को नहीं तोड़ा कि वह कहाँ जा सकता है, लेकिन उसने आपके निर्देशों की भावना का उल्लंघन किया।
वर्तमान सुरक्षा प्रणालियाँ केवल कीकार्ड और कमरों की सूची की जाँच करती हैं। वे यह नहीं पूछतीं: "क्या अभी यह करना एक अच्छा विचार है?"
समाधान: AgentBound
यह पेपर AgentBound को पेश करता है, जो एक "स्मार्ट बाउंसर" की तरह है जो रोबốt और उसके कार्य के बीच खड़ा रहता है। यह रोबोट को अधिक स्मार्ट बनाने की कोशिश नहीं करता है; यह बस रोबोट द्वारा किए जाने वाले हर एक कदम की जाँच करता है।
यह कैसे काम करता है, यहाँ एक रचनात्मक उपमा दी गई है:
तीन न्यायाधीश (The Three Judges)
जब रोबोट कुछ करना चाहता है (जैसे ईमेल भेजना या पैसे ट्रांसफर करना), तो AgentBound उस अनुरोध को तीन अलग-अलग "न्यायाधीशों" के पास भेजता है जो उस पर वोट करते हैं:
- द गेटकीपर (प्रत्यायोजित प्राधिकरण/Delegated Authorization): यह न्यायाधीश आईडी की जाँच करता है। "क्या तुम्हारे पास सही चाबी है? क्या तुम्हें इस मशीन को छूने की अनुमति है?" यदि उत्तर 'नहीं' है, तो कार्रवाई तुरंत रुक जाती है।
- मालिक की इच्छा (व्यवहार संबंधी संविधान/Behavioral Constitution): यह एक डिजिटल दस्तावेज़ है जिस पर आपके (मानव बॉस) के हस्ताक्षर हैं। यह कहता है जैसे, "मुझसे पूछे बिना कभी भी $500 से अधिक न भेजें," या "सप्ताहांत (weekends) पर कभी भी समाचार प्रकाशित न करें।" यह न्यायाधीश पूछता है, "क्या यह क्रिया उस चीज़ से मेल खाती है जो बॉस वास्तव में चाहते हैं?"
- साइट गार्डियन (साइट एक्शन कॉन्ट्रैक्ट/Site Action Contract): यह न्यायाधीश उस विशिष्ट मशीन या वेबसाइट को देखता है जिसे रोबोट उपयोग करने की कोशिश कर रहा है। यह पूछता है, "क्या यह क्रिया इस विशिष्ट सिस्टम के लिए सुरक्षित है? क्या यह परिवर्तनीय (reversible) है? क्या यह इस विशिष्ट वेबसाइट के नियमों को तोड़ता है?"
निर्णय (The Verdict)
ये तीन न्यायाधीश स्वतंत्र रूप से मतदान करते हैं। AgentBound उनके वोटों को जोड़ने के लिए एक सख्त नियम पुस्तिका का उपयोग करता है:
- यदि कोई भी न्यायाधीश "नहीं" (Deny) कहता है, तो क्रिया को रोक दिया जाता है।
- यदि गेटकीपर "हाँ" कहता है लेकिन मालिक की इच्छा कहती है, "इंसान का इंतज़ार करें," तो रोबole को रुकना होगा और आपकी स्वीकृति का इंतज़ार करना होगा।
- केवल तभी जब सभी न्यायाधीश सहमत हों कि यह सुरक्षित और अनुमत है, रोबोट को कार्य करने के लिए हरी झंडी मिलती है।
"जादुई रसीद" (गवर्नेंस रसीदें/Governance Receipts)
यह सबसे महत्वपूर्ण हिस्सा है। अतीत में, यदि कुछ गलत हो जाता था, तो आप एक लॉगबुक देखते थे जिसमें केवल लिखा होता था, "रोबोट ने रात 3 बजे पैसे भेजे।" आपको यह पता नहीं चलता था कि सिस्टम ने इसे क्यों होने दिया।
AgentBound एक गवर्नेंस रसीद (Governance Receipt) बनाता है। इसे एक डिजिटल नोटरी स्टैम्प की तरह समझें। जब भी रोबोट कोई कार्य करता है, तो उसे एक रसीद मिलती है जो प्रमाणित करती है:
- ठीक कौन से नियमों की जाँच की गई।
- आपकी "मालिक की इच्छा" का कौन सा संस्करण उपयोग किया गया था।
- कि तीनों न्यायाधीशों ने वास्तव में वोट दिया।
- और कि क्रिया को मंजूरी दी गई थी।
यह रसीद क्रिप्टोग्राफिक रूप से हस्ताक्षरित (cryptographically signed) है। इसका मतलब है कि कोई भी इसे फर्जी नहीं बना सकता, और कोई भी इसे बाद में बदल नहीं सकता। यदि रोबोट कुछ गलत करता है, तो आप रसीद देख सकते हैं और कह सकते हैं, "आह, गेटकीपर ने हाँ कहा था, लेकिन मालिक की इच्छा ने नहीं कहा था। सिस्टम विफल रहा।" या, "सिस्टम पूरी तरह से काम कर रहा था, और रसीद साबित करती है कि रोबोट नियमों का पालन कर रहा था।"
"स्टैंडिंग डेलीगेशन" (उन रोबोटों के लिए जो कभी नहीं सोते)
कुछ रोबोट 24/7 काम करते हैं, जो आपके सोने के दौरान भी निर्णय लेते हैं। आमतौर पर, यदि आप इन रोबोटों के लिए नियम बदलना चाहते हैं, तो आपको उन्हें जगाना पड़ता है और उनकी चाबियाँ फिर से जारी करनी पड़ती हैं।
AgentBound स्टैंडिंग डेलीगेशन (Standing Delegation) का उपयोग करता है। कल्पना कीजिए कि आप रोबोट को एक "मास्टर की" देते हैं जो एक वर्ष के लिए वैध है, लेकिन यह केवल उन "टास्क डोर्स" (कार्य द्वारों) को खोल सकती है जो केवल 10 मिनट के लिए वैध हैं।
- हर 10 मिनट में, रोबोट एक नया "टास्क डोर" की (चाबी) मांगता है।
- जब वह मांगता है, तो सिस्टम आपके वर्तमान नियमों की जाँच करता है। यदि आपने कल ही अपना मन बदल लिया था और कहा था कि "सोमवार को कोई रिफंड नहीं," तो नई 10-मिनट की चाबी में वह बदलाव स्वतः ही प्रतिबिंबित होगा।
- इस तरह, आपको रोबोट को लगातार अधिकृत करने की आवश्यकता के बिना, रोबोट आपके नियमों के साथ अपडेट रहता है।
सारांश
AgentBound एक ऐसा सिस्टम है जो AI एजेंटों में "सामान्य ज्ञान" और "जवाबदेही" की एक परत जोड़ता है।
- पुराना तरीका: "आपके पास चाबी है, इसलिए आप जा सकते हैं।" (संदर्भ के प्रति अंधा)।
- AgentBound का तरीका: "आपके पास चाबी है, लेकिन क्या आपने नियमों की जाँच की? क्या बॉस ने मंजूरी दी? क्या यह मशीन के लिए सुरक्षित है? यहाँ एक हस्ताक्षरित रसीद है जो प्रमाणित करती है कि हमने यह सब जाँच लिया है।"
यह AI गवर्नेंस को ऐसी चीज़ में बदल देता है जिसे आपको केवल "भरोसा" नहीं करना होता, बल्कि जिसे आप सत्यापित (verify) कर सकते हैं।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।