← नवीनतम पेपर
🤖 AI

Beyond Autonomy: A Dynamic Tiered AgentRunner Framework for Governable and Resilient Enterprise AI Execution

यह शोध पत्र डायनेमिक टियर्ड एजेंटरनर (Dynamic Tiered AgentRunner) का प्रस्ताव करता है, जो एक ऐसा ढांचा है जिसे जोखिम-अनुकूलित संसाधन आवंटन, पृथक एजेंटों के साथ शक्तियों के पृथक्करण वाली वास्तुकला और वर्तमान स्वायत्त एजेंट प्रणालियों में शासन की कमी को दूर करने के लिए एक विफलता-सहनशील सत्यापन लूप को लागू करके एंटरप्राइज एआई सुरक्षा और लचीलेपन को बढ़ाने के लिए डिज़ाइन किया गया है।

मूल लेखक: Kai Pan, Rong Hou

प्रकाशित 2026-05-12
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Kai Pan, Rong Hou

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक व्यस्त, उच्च-जोखिम वाली रसोई चला रहे हैं। अतीत में, "AI कुकिंग" का चलन एक अत्यंत बुद्धिमान शेफ को काम पर रखने और उसे यह बताने का था, "जाओ 500 लोगों के लिए 5-कोर्स का भोजन तैयार करो, और जब तक यह पूरा न हो जाए, तब तक रुकना मत।" विचार यह था कि आप शेफ को जितनी अधिक स्वतंत्रता (स्वायत्तता) देंगे, भोजन उतना ही बेहतर होगा।

लेकिन वास्तविक दुनिया के एंटरप्राइज बिजनेस में, यह दृष्टिकोण खतरनाक है। यदि वह एक अकेला शेफ भ्रमित हो जाता है, गलत जानकारी (hallucinate) देने लगता, या बहुत अधिक महत्वाकांक्षी हो जाता है, तो वह अनजाने में रसोई में आग लगा सकता है, गलत टेबल पर ज़हर परोस सकता है, या एक साधारण सैंडविच के ऑर्डर के लिए पूरे बजट को ट्रफल्स (truffles) पर खर्च कर सकता है।

"बियॉन्ड ऑटोनॉमी" (Beyond Autonomy) नामक शोध पत्र तर्क देता है कि समस्या यह नहीं है कि हमारे AI शेफ पर्याप्त बुद्धिमान नहीं हैं; समस्या यह है कि वे पर्याप्त शासित (governable) नहीं हैं। उन्हें एक ऐसे सिस्टम की आवश्यकता है जो उन्हें सुरक्षित, कुशल और जवाबदेह बनाए रखे।

यहाँ बताया गया है कि उनका समाधान, डायनेमिक टियर्ड एजेंटरनर (Dynamic Tiered AgentRunner), रोजमर्रा के उपमाओं का उपयोग करते हुए कैसे काम करता है:

1. "ट्रैफिक लाइट" प्रणाली (जोखिम-अनुकूलित टियरिंग)

हर कार्य के साथ एक जैसा व्यवहार करने के बजाय, यह ढांचा एक स्मार्ट ट्रैफिक नियंत्रण प्रणाली की तरह कार्य करता है। यह एक अनुरोध को देखता है और पूछता है: "यह कितना जोखिम भरा है?"

  • ग्रीन लाइट (लाइट टियर): यदि आप बस पूछते हैं, "मौसम कैसा है?" या "मेन्यू दिखाएं," तो सिस्टम AI को एक त्वरित, सीधा रास्ता देता है। यह तेज़ और सस्ता है। एक साधारण प्रश्न के लिए किसी को भी दोबारा जांच करने की आवश्यकता नहीं है।
  • येलो लाइट (स्टैंडर्ड टियर): यदि अनुरोध में कुछ बदलना शामिल है (जैसे "इस आइटम की कीमत अपडेट करें"), तो AI को कार्य करने से पहले एक "क्रिटिक" (समीक्षक) से दूसरी राय लेने के लिए रुकना पड़ता है।
  • रेड लाइट (फुल टियर): यदि अनुरोध खतरनाक है (जैसे "सभी ग्राहक रिकॉर्ड हटा दें" या "देश भर के सभी स्टोरों के लिए कीमतें बदल दें"), तो सिस्टम ब्रेक लगा देता है। इसके लिए पूर्ण समीक्षा, सुरक्षा जांच और चीजें गलत होने पर उन्हें ठीक करने की योजना की आवश्यकता होती है।

जादू: यह सिस्टम डायनेमिक (गतिशील) है। यदि AI एक "ग्रीन लाइट" कार्य शुरू करता है लेकिन अचानक कुछ जोखिम भरा करने की कोशिश करता है, तो सिस्टम खतरे को रोकने के लिए इसे तुरंत "रेड लाइट" में अपग्रेड कर देता है। इससे पैसा बचता है क्योंकि आप एक साधारण प्रश्न की जांच के लिए पूरी सुरक्षा टीम को भुगतान नहीं कर रहे होते हैं।

2. "संविधान" (शक्तियों का पृथक्करण)

कई वर्तमान AI सिस्टम में, वही एजेंट जो विचार लाता है, वही यह भी जांचता है कि क्या वह सुरक्षित है और फिर उसे करता है। यह एक छात्र द्वारा परीक्षा लिखने, स्वयं अपने पेपर को ग्रेड करने और फिर उसे ग्रेड के लिए सौंपने जैसा है। यह गलतियों या धोखाधड़ी का नुस्खा है।

यह ढांचा एक सख्त शक्तियों के पृथक्करण (Separation of Powers) का उपयोग करता है, जो सरकार के समान है:

  • वर्कर (विधायिका/Legislative): योजना प्रस्तावित करता है।
  • क्रिटिक (न्यायपालिका/Judicial): योजना की समीक्षा करता है और "ना" कह सकता है या "इसे ठीक करो" कह सकता है।
  • टूलगेटवे (कार्यपालिका/Executive): यह सबसे महत्वपूर्ण हिस्सा है। यह एक भौतिक द्वारपाल (physical gatekeeper) है। भले ही वर्कर और क्रिटिक सहमत हों, कुछ भी तब तक नहीं होता जब तक वह इस गेट से पार न हो जाए। गेट अनुमतियों और नियमों की जांच करता है। AI इस गेट के आसपास "बातचीत" करके बच नहीं सकता; यह सिस्टम में हार्ड-कोडेड है।

3. "सुरक्षा जाल" (डिजाइन द्वारा लचीलापन)

पुराने AI सिस्टम मानते हैं कि पहली कोशिश एकदम सटीक होनी चाहिए। यदि यह विफल होता है, तो पूरा सिस्टम क्रैश हो जाता है। यह ढांचा मानता है कि विफलता सामान्य है।

  • वेरिफायर (Verifier): AI द्वारा कुछ करने के बाद, एक अलग एजेंट परिणाम की जांच करता है। क्या इसने वास्तव में काम किया? क्या डेटा सही है?
  • रिकवरी एजेंट (Recovery Agent): यदि वेरिफायर कहता है, "ओह, यह काम नहीं किया," तो रिकवरी एजेंट घबराता नहीं है। वह देखता है कि क्या गलत हुआ, इसे ठीक करने के लिए एक नई योजना बनाता है, और फिर से प्रयास करता है।
  • रिट्रोस्पेक्टर (Retrospector): काम पूरा होने के बाद (चाहे वह सफल हुआ हो या विफल), यह एजेंट एक "सीखे गए सबक" का नोट लिखता है ताकि पूरी संस्था अगली बार के लिए और स्मार्ट बन सके।

परिणाम: यह क्यों मायने रखता है

शोधकर्ताओं ने इसका परीक्षण एक वास्तविक व्यावसायिक प्लेटफॉर्म (एक बड़ी कंपनी के लिए स्टोर, शेड्यूल और प्रशिक्षण का प्रबंधन करना) में किया। यहाँ क्या हुआ:

  • सुरक्षा: इसने लगभग सभी खतरनाक गलतियों को पकड़ लिया (जोखिम भरे कार्यों पर केवल 0.5% त्रुटि दर), जो अत्यधिक सख्त नियंत्रण वाले सिस्टम की सुरक्षा के बराबर है।
  • गति और लागत: क्योंकि इसने सरल कार्यों की अत्यधिक जांच करने में समय बर्बाद नहीं किया, इसलिए यह "सब कुछ चेक करने" वाले दृष्टिकोण की तुलना में 47% तेज़ और 58% सस्ता था।
  • सफलता दर: इसने भारी-हाथ वाले (heavy-handed) सिस्टम की तुलना में अधिक कार्यों (88.9%) को हल किया क्योंकि यह सरल नौकरियों के लिए अनावश्यक नौकरशाही में नहीं फंसा।

मुख्य निष्कर्ष

लेख का निष्कर्ष है कि शासन (governance) स्वतंत्रता का दुश्मन नहीं है; यह इसकी नींव है।

जिस तरह एक ड्राइवर को हाईवे पर सुरक्षित रूप से चलाने के लिए ट्रैफिक लाइट और सीटबेल्ट की आवश्यकता होती है, उसी तरह एक AI को वास्तव में उपयोगी होने के लिए एक संरचित, टियर्ड और जांचे गए सिस्टम की आवश्यकता होती है। आप एक शक्तिशाली, स्वायत्त AI नहीं रख सकते जो सुरक्षित और विश्वसनीय भी हो, जब तक कि आप एक ऐसा "संविधान" नहीं बनाते जो उसे नियंत्रण में रखे।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →