← नवीनतम पेपर
🤖 AI

OpenPort Protocol: A Security Governance Specification for AI Agent Tool Access

यह शोध पत्र ओपनपोर्ट प्रोटोकॉल (OpenPort Protocol) को प्रस्तुत करता है, जो एक सुरक्षा गवर्नेंस विनिर्देश है जो न्यूनतम-विशेषाधिकार प्राधिकरण (least-privilege authorization), मानव समीक्षा के साथ जोखिम-गेटेड राइट निष्पादन (risk-gated write execution), स्टेट रीवैलिडेशन (state revalidation), और नियत ऑडिटेबिलिटी (deterministic auditability) वाले सर्वर-साइड गेटवे के माध्यम से सुरक्षित, मॉडल-न्यूट्रल एआई एजेंट टूल एक्सेस को सक्षम बनाता है।

मूल लेखक: Genliang Zhu, Chu Wang, Ziyuan Wang, Zhida Li, Qiang Li

प्रकाशित 2026-02-25
📖 7 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Genliang Zhu, Chu Wang, Ziyuan Wang, Zhida Li, Qiang Li

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आपने एक शानदार, बेहद बुद्धिमान रोबोट सहायक (एक AI एजेंट) बनाया है जो अद्भुत काम कर सकता है: उड़ानें बुक करना, आपके बैंक खाते का प्रबंधन करना और आपके कैलेंडर को व्यवस्थित करना। आप चाहते हैं कि यह रोबोट आपके काम करने के लिए सीधे आपके ऐप्स से बात करे।

लेकिन समस्या यह है: यदि आप बस रोबोट को अपने घर की चाबियाँ सौंप देते हैं, तो वह गलती से आपका पसंदीदा फूलदान गिरा सकता है, किसी अजनबी को अंदर आने दे सकता है, या आपके किसी मजाक को गलत समझकर आपका घर बेचने की कोशिश कर सकता है।

ओपनपोर्ट प्रोटोकॉल (OpenPort Protocol - OPP) एक अति-सुरक्षित, नियमों से बंधा एयरलॉक है जिसे आप अपने रोबोट और अपने घर के बीच स्थापित करते हैं। यह रोबोट को काम करने से नहीं रोकता है; यह बस यह सुनिश्चित करता है कि रोबोट सख्त नियमों का पालन करे, बड़े कदमों के लिए अनुमति ले, और जो कुछ भी वह करता है उसका एक लिखित रिकॉर्ड छोड़े।

यहाँ बताया गया है कि ओपनपोर्ट कैसे काम करता है, सरल उपमाओं (analogies) में विभाजित किया गया है:

1. "स्मार्ट बाउंसर" (प्राधिकरण और खोज - Authorization & Discovery)

पुराने दिनों में, आप शायद रोबोट को एक मास्टर की (master key) दे देते थे। ओपनपोर्ट कहता है: "कोई मास्टर की नहीं।"

इसके बजाय, रोबोट को दरवाजा खटखटाना होगा और पूछना होगा, "मैं क्या कर सकता हूँ?"

  • द मेनिफेस्ट (The Manifest): बाउंसर (ओपनपोर्ट गेटवे) रोबोट को एक मेनू दिखाता है। लेकिन यहाँ जादू यह है: मेनू इस आधार पर बदलता है कि वह रोबोट कौन है। यदि रोबोट को केवल मौसम देखने की अनुमति है, तो मेनू केवल "मौसम" दिखाएगा। यह "बैंक खाता डिलीट करें" वाला बटन तक नहीं दिखाएगा।
  • उपमा: एक वीआईपी क्लब की कल्पना करें। यदि आप एक नियमित सदस्य हैं, तो बाउंसर आपको डांस फ्लोर दिखाता है। यदि आप "नो अल्कोहल" रिस्टबैंड वाले अतिथि हैं, तो बाउंसर आपको डांस फ्लोर तो दिखाता है लेकिन बार को छिपा देता है। रोबोट को बार का अस्तित्व तब तक पता ही नहीं चलता जब तक कि उसके पास सही अनुमति न हो।

2. "ड्राफ्टिंग रूम" (सुरक्षित लेखन - Safe Writing)

यह सबसे महत्वपूर्ण हिस्सा है। यदि रोबोट आपके ईमेल को पढ़ना चाहता है, तो वह ऐसा तुरंत कर सकता है। लेकिन यदि वह लिखना चाहता है (ईमेल भेजना, फ़ाइल डिलीट करना, पैसे ट्रांसफर करना), तो ओपनपोर्ट कहता है: "रुकिए! पहले एक ड्राफ्ट लिखते हैं।"

  • प्रक्रिया: रोबोट कहता है, "मैं सीईओ को एक ईमेल भेजना चाहता हूँ।" ओपनपोर्ट उसे भेजता नहीं है। इसके बजाय, यह एक ड्राफ्ट (Draft) बनाता है और उसे "अनुमोदन के लिए लंबित" (Pending Approval) बॉक्स में रखता है।
  • मानवीय जाँच (The Human Check): एक मानव प्रबंधक (आप या एक एडमिन) ड्राफ्ट को देखता है। "हम्म, क्या रोबलेट वास्तव में यह भेजना चाहता था? क्या यह सुरक्षित है?" यदि हाँ, तो वे "अनुमोदन (Approve)" पर क्लिक करते हैं, और तभी ईमेल भेजा जाता है।
  • उपमा: इसे एक बैंक चेक की तरह समझें। रोबोट चेक लिखता है (ड्राफ्ट), लेकिन बैंक (ओपनपोर्ट) इसे तब तक रोक कर रखता है जब तक कि एक मानव प्रबंधक इस पर हस्ताक्षर न कर दे। पैसा खाते से तब तक नहीं निकलता जब तक कि वह हस्ताक्षर वहां न हो। यह रोबोट को गलत व्यक्ति को गलती से $1 मिलियन भेजने से रोकता है क्योंकि वह भ्रमित हो गया था।

3. "टाइम-ट्रैवल प्रूफ" (प्रीफ्लाईट और इडेम्पोटेंसी - Preflight & Idempotency)

कभी-कभी, जब आप अनुमोदन की प्रतीक्षा कर रहे होते हैं, तो दुनिया बदल जाती है।

  • समस्या: रोबोट कहता है कि "'प्रोजेक्ट अल्फा' नामक फ़ाइल को डिलीट करें।" आप उसे मंजूरी देते हैं। लेकिन जब तक आप सोच रहे थे, किसी और ने उस फ़ाइल का नाम बदलकर "प्रोजेक्ट बीटा" कर दिया। यदि रोबोट अब इसे डिलीट करता है, तो वह गलत चीज़ डिलीट कर सकता है।
  • समाधान (Preflight): डिलीट करने के लिए पूछने से पहले ही, ओपनपोर्ट एक "सिमुलेशन" चलाता है। यह गणना करता है कि बिल्कुल क्या होने वाला है, जिसका एक फिंगरप्रिंट (hash) होता है। जब रोबोट अंततः निष्पादित (execute) करने की कोशिश करता है, तो ओपनपोर्ट जाँचता है: "क्या फिंगरप्रिंट सिमुलेशन से मेल खाता है?" यदि फ़ाइल बदल गई है, तो फिंगरप्रिंट मेल नहीं खाता है, और ओपनपोर्ट कहता है, "रुकिए! स्थिति बदल गई है। फिर से मानव से पूछें।"
  • उपमा: यह एक कस्टम पिज्जा ऑर्डर करने जैसा है। आप पिज्जा का वर्णन करते हैं (ड्राफ्ट)। खाना पकाने से पहले, शेफ सामग्री की जाँच करता है। यदि आपके इंतजार के दौरान टमाटर सॉस खत्म हो गया, तो शेफ कहता है, "हम अब यह सटीक पिज्जा नहीं बना सकते। ग्राहक से फिर से पूछें।"

4. "ब्लैक बॉक्स" (ऑडिट ट्रेल्स - Audit Trails)

ओपनपोर्ट मांग करता है कि सब कुछ एक अपरिवर्तनीय लॉगबुक में रिकॉर्ड किया जाए।

  • नियम: हर बार जब रोबोट कुछ मांगता है, उसे मना किया जाता है, या उसे मंजूरी दी जाती है, तो एक रिकॉर्ड बनाया जाता है। यह रिकॉर्ड करता है कि किसने पूछा, उसने क्या पूछा, उसे क्यों मना किया गया, और किसने मंजूरी दी।
  • उपमा: एक विमान के ब्लैक बॉक्स (flight recorder) की कल्पना करें। यदि रोबोट क्रैश हो जाता है या कुछ अजीब करता है, तो आप लॉगबुक देख सकते हैं और देख सकते हैं कि वास्तव में क्या हुआ था। आप लॉगबुक को मिटा नहीं सकते, और रोब जाता अपने पदचिह्नों को छिपा नहीं सकता।

5. "स्पीड लिमिट" (रेट लिमिटिंग - Rate Limiting)

क्या होगा यदि रोबोट एक लूप में फंस जाता है और एक सेकंड में लाखों बार चीजें मांगने की कोशिश करता है?

  • समाधान: ओपनपोर्ट रोबोट पर एक गति सीमा (speed limit) लगा देता है। यदि वह बहुत तेज़ी से पूछता है, तो सिस्टम कहता है, "धीमे हो जाइए!" और एक विनम्र त्रुटि संदेश (जैसे कि "429 Too Many Requests" का साइन) देता है जो रोबोट को रुकने के लिए कहता है।
  • उपमा: यह एक टोल बूथ की तरह है। यदि 1,000 कारें एक साथ प्रवेश करने की कोशिश करती हैं, तो बूथ लेन को बंद कर देता है और कहता है, "अपनी बारी का इंतज़ार करें।" यह सिस्टम को क्रैश होने या अभिभूत होने से रोकता है।

हमें इसकी आवश्यकता क्यों है?

AI एजेंट शक्तिशाली इंटर्न की तरह हैं। वे तेज़ और उत्साही हैं, लेकिन वे अनाड़ी, आसानी से ठगे जाने वाले (बुरे निर्देशों द्वारा), या भ्रमित हो सकते हैं।

  • OpenPort के बिना: आप उन्हें एक मास्टर की दे देते हैं। वे अनजाने में पूरे कंपनी डेटाबेस को डिलीट कर सकते हैं क्योंकि उन्होंने एक प्रॉम्प्ट को गलत पढ़ लिया।
  • OpenPort के साथ: आप उन्हें एक प्रतिबंधित कीकार्ड (restricted keycard) देते हैं। वे केवल उन्हीं दरवाजों को खोल सकते हैं जिन्हें खोलने की उन्हें अनुमति है। यदि वे एक भारी बक्सा हिलाना चाहते हैं (एक जोखिम भरा कार्य), तो उन्हें एक फॉर्म भरना होगा, एक मैनेजर के हस्ताक्षर का इंतजार करना होगा, और यह साबित करना होगा कि वे बक्से को उल्टा नहीं पकड़े हुए हैं।

निचोड़ (The Bottom Line)

ओपनपोर्ट सुरक्षा के लिए एक नियम पुस्तिका है। यह सुनिश्चित करता है कि जब AI एजेंट हमारे वास्तविक दुनिया के उपकरणों के साथ बातचीत करते हैं, तो वे न्यूनतम विशेषाधिकार (केवल वही करना जो उनके लिए बिल्कुल आवश्यक है), मानवीय निरीक्षण (बड़े निर्णयों के लिए), और पूर्ण स्मृति (ताकि यदि चीजें गलत होती हैं तो हमें पता हो कि क्या हुआ था) के साथ कार्य करें। यह एक अराजक, खतरनाक फ्री-फॉर-ऑल को एक सुरक्षित, अनुमानित और ऑडिट योग्य वर्कफ़्लो में बदल देता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →