The Agent Operating System (AOS): A Reference Operating Architecture for Distributed Agentic Systems
यह शोध पत्र एजेंट ऑपरेटिंग सिस्टम (AOS) का प्रस्ताव करता है, जो एक वेंडर-न्यूट्रल संदर्भ आर्किटेक्चर है जो नियंत्रण और शासन (Control & Governance) तथा रनटाइम और समन्वय (Runtime & Coordination) की एक द्वि-स्तरीय संरचना को परिभाषित करता है ताकि मौजूदा बुनियादी ढांचे को बदले बिना विषम एजेंटिक घटकों को शासन योग्य, विश्वसनीय और अंतर-संचालनीय वितरित प्रणालियों में संयोजित किया जा सके।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
महान एआई अराजकता और एक ट्रैफिक पुलिस की आवश्यकता
कल्पना कीजिए कि आप एक ऐसा रोबोट बना रहे हैं जो न केवल निर्देशों के एक सेट का पालन करता है, बल्कि सोच सकता है, योजना बना सकता है और काम पूरा करने के लिए दुनिया में जा सकता है। यह एजेंटिक एआई (Agentic AI) का रोमांचक नया मोर्चा है। अतीत के चैटबॉट्स के विपरीत, जो केवल आपके प्रश्न टाइप करने का इंतज़ार करते थे और फिर उत्तर देते थे, ये नए "एजेंट्स" छोटे डिजिटल कर्मचारियों की तरह हैं। वे जानकारी खोज सकते हैं, उपकरणों (tools) का उपयोग कर सकते हैं, अन्य रोबots से बात कर सकते हैं, और जटिल समस्याओं को हल करने के लिए अपने आप निर्णय भी ले सकते हैं।
लेकिन यहाँ एक पेचीदा बात है: जब आपके पास एक रोबोट होता है, तो उसे देखना आसान होता है। लेकिन जब आपके पास उनकी एक पूरी टीम होती है, जो आपस में बात कर रही हो, उपकरणों को उधार ले रही हो, और वास्तविक समय में निर्णय ले रही हो, तो चीजें बहुत जल्दी अस्त-व्यस्त हो सकती हैं। प्रभारी कौन है? यदि रोबोट A, रोबोट B को कुछ करने के लिए कहता है, तो क्या रोबोट B को इसे करने का अधिकार है? क्या होगा यदि रोबोट B कोई गलती कर देता है? कंप्यूटर विज्ञान की दुनिया में, हम आमतौर पर बुनियादी चीजों को प्रबंधित करने के लिए एक ऑपरेटिंग सिस्टम (जैसे विंडोज या लिनक्स) पर भरोसा करते हैं: कि किसे मेमोरी का उपयोग करने का अधिकार है, कौन एक फ़ाइल खोल सकता है, और चीज़ों को सुचारू रूप से कैसे चलाया जाए। लेकिन पारंपरिक ऑपरेटिंग सिस्टम क्लब के बाउंसरों की तरह होते हैं; वे आईडी चेक करते हैं और सिर गिनते हैं, लेकिन वे यह नहीं समझते कि आप क्यों वहाँ हैं या आपकी योजना का अर्थ क्या है। वे यह नहीं जानते कि एक रोबोट कविता लिखने की कोशिश कर रहा है या एक बैंक खाता डिलीट करने की कोशिश कर रहा है।
यही कारण है कि हमें कुछ नया चाहिए। हमें एक ऐसे सिस्टम की आवश्यकता है जो काम के गणित को ही नहीं, बल्कि उसके अर्थ को भी समझ सके। हमें यह सुनिश्चित करने के तरीके की आवश्यकता है कि भले ही रोबोट संभाव्यता (probabilistic) के आधार पर अनुमान लगा रहे हों (जिसका अर्थ है कि वे उत्तर के बारे में 100% निश्चित नहीं हैं), पूरी टीम सुरक्षित रहे, नियमों का पालन करे, और बाद में यह समझा सके कि उन्होंने क्या किया। यही वह समस्या है जिसे पेपर "AOS-0001" हल करने की कोशिश कर रहा है।
एजेंट ऑपरेटिंग सिस्टम: एक डिजिटल शहर का ब्लूप्रिंट
आप जो पेपर पढ़ रहे हैं वह एक नया ब्लूप्रिंट प्रस्तावित करता है जिसे एजेंट ऑपरेटिंग सिस्टम (AOS) कहा जाता है। इसे एक विशिष्ट सॉफ्टवेयर के रूप में न देखें जिसे आप आज डाउनलोड कर सकें, बल्कि इसे वास्तुशिल्प के नियमों के एक सेट—एक "संविधान"—के रूप में देखें—कि एआई एजेंटों के लिए एक सुरक्षित, व्यवस्थित शहर कैसे बनाया जाए। लेखक, अंकुर शर्मा और दीप शाह, सुझाव देते हैं कि वर्तमान में, एआई एजेंटों की दुनिया एक जंगली पश्चिम (wild west) शहर की तरह है जहाँ हर कोई अपनी खुद की बाड़ और नियम बना रहा है, जिससे भ्रम और संभावित खतरा पैदा हो रहा है। वे एक ऐसा नक्शा चाहते हैं जिस पर सभी सहमत हो सकें।
दो-स्तरीय शहर: मेयर का कार्यालय और निर्माण दल
इस पेपर का मुख्य विचार एआई एजेंटों के प्रबंधन को दो अलग-अलग "प्लेन" या परतों में विभाजित करना है, जो एक साथ काम करते हैं लेकिन जिनके कार्य बहुत अलग होते हैं। लेखक एक शहर के सहायक रूपक का उपयोग करते हैं:
कंट्रोल और गवर्नेंस प्लेन (मेयर का कार्यालय): यह संचालन का मस्तिष्क है। इसका काम बड़े सवालों के जवाब देना है: हम क्या करने की कोशिश कर रहे हैं? हमें इसे करने की अनुमति किसने दी? हमें किन नियमों का पालन करना चाहिए? हमें इस बात का कितना विश्वास है कि यह एक अच्छा विचार है?
- कल्पना कीजिए कि एक मेयर "पार्क ठीक करने" के अनुरोध को देख रहा है। मेयर फावड़ा नहीं उठाता। इसके बजाय, मेयर बजट देखता है, यह सत्यापित करता है कि अनुरोध करने वाले व्यक्ति के पास मरम्मत का आदेश देने का अधिकार है, यह जाँचता है कि क्या पार्क बाढ़ क्षेत्र में है, और निर्णय लेता है कि क्या योजना सुरक्षित है।
- एआई की दुनिया में, यह प्लेन इरादे (Intent) (लक्ष्य), अधिकार (Authority) (किसे क्या करने की अनुमति है), नीति (Policy) (नियम), और विश्वास (Confidence) (हम कितने आश्वस्त हैं) को संभालता है। यह "हाँ" या "ना" का निर्णय लेता है।
रनटाइम और कोऑर्डिनेशन प्लेन (निर्माण दल): यह शरीर (muscle) है। एक बार जब मेयर "जाओ" कहता है, तो यह प्लेन वास्तविक काम संभालता है। यह सही उपकरण ढूंढता है, सही श्रमिकों को काम पर रखता है (जो अन्य एआई मॉडल, मानव कार्यकर्ता या सॉफ़्टवेयर टूल हो सकते हैं), और सुनिश्चित करता है कि काम पूरा हो जाए।
- यदि मेयर कहता है "पार्क ठीक करें," तो निर्माण दल सबसे अच्छा फावड़ा, सबसे अच्छा कार्यकर्ता और काम करने का सबसे अच्छा समय ढूंढता है। वे लॉजिस्टिक्स, ट्रैफ़िक और शेड्यूलिंग को संभालते हैं।
- एआई की दुनिया में, यह प्लेन एजेंट लाइफसाइकिल (सुनिश्चित करना कि एजेंट सही ढंग से शुरू और बंद हों), रूटिंग (कार्यों को सही जगह भेजना), और शेड्यूलिंग (चीजों को बाधित होने से बचाना) का प्रबंधन करता है।
पेपर का तर्क है कि लंबे समय से, हम इन दोनों कामों को मिला रहे हैं। हम निर्माण दल (वह कोड जो एआई चलाता है) को यह तय करने दे रहे हैं कि कुछ करना सुरक्षित है या नहीं, जो कि एक निर्माण कार्यकर्ता को यह तय करने देने जैसा है कि उसके पास भवन निर्माण की अनुमति है या नहीं। लेखक सुझाव देते हैं कि सुरक्षा और नियंत्रण के लिए इन भूमिकाओं को अलग करना महत्वपूर्ण है।
"कैपेबिलिटी" (क्षमता) का जादू
इस पेपर का एक सबसे चंचल और महत्वपूर्ण विचार कैपेबिलिटी (Capability) की अवधारणा है। आमतौर पर, जब हम किसी एआई से बात करते हैं, तो हम कह सकते हैं, "इसकी गणना करने के लिए सर्वर पर पायथन कोड का उपयोग करें।" लेकिन पेपर सुझाव देता है कि हमें कैसे किया जाता है इस पर सोचने के बजाय, क्या किया जाता है इस पर सोचना चाहिए।
कल्पना कीजिए कि आप पिज्जा ऑर्डर कर रहे हैं। आप रेस्टोरेंट को यह नहीं बताते कि "ओवन में जाओ, पेपरोनी का एक टुकड़ा उठाओ, आटे पर रखो और 400 डिग्री पर पकाओ।" आप बस कहते हैं, "मुझे एक पेपरोनी पिज्जा चाहिए।" रेस्टोरेंट (एआई सिस्टम) खुद पता लगा लेता है कि कौन सा शेफ खाली है, कौन सा ओवन गर्म है, और आटा कहाँ है।
AOS में, "पेपरोनी पिज्जा" एक कैपेबिलिटी है। यह एक परिणाम के लिए एक स्थिर लेबल है, जैसे "इस दस्तावेज़ का सारांश दें" या "मौसम की जाँच करें।" सिस्टम फिर बिना आपको पता चले "शेफ" (विशिष्ट एआई मॉडल या टूल) को बदल सकता है। यदि एक शेफ बीमार हो जाता है, तो सिस्टम बस दूसरे शेफ को ऑर्डर भेज देता है जो वही पिज्जा बना सकता है। यह पूरे सिस्टम को लचीला और विश्वसनीय बनाता है।
"डेलीगेशन" (प्रत्यायोजन) की कमान श्रृंखला
पेपर एक पेचीदा समस्या को भी संबोधित करता है: डेलीगेशन (Delegation)। क्या होता है जब मुख्य एआई एजेंट किसी छोटे एआई एजेंट को कार्य करने के लिए कहता है? क्या छोटा एजेंट अचानक सब कुछ करने की शक्ति प्राप्त कर लेता है?
लेखक कहते हैं "बिल्कुल नहीं।" वे अथॉरिटी प्रिजर्वेशन (Authority Preservation) नामक एक सख्त नियम का प्रस्ताव करते हैं। इसे एक माता-पिता द्वारा बच्चे को दोपहर के भोजन के लिए थोड़े से पैसे देने के समान समझें। बच्चा दोपहर का भोजन खरीद सकता है, लेकिन वह कार नहीं खरीद सकता। यदि बच्चा कार खरीदने की कोशिश करता है, तो सिस्टम उसे रोक देना चाहिए।
AOS ब्लूप्रिंट में, हर बार जब एक एजेंट कार्य को डेलीगेट करता है, तो वह एक "अनुमति पर्ची" पास करता है जो सख्ती से सीमित होती है। बच्चा केवल वही कर सकता है जिसकी अनुमति माता-पिता ने दी है, केवल उतनी देर के लिए जितनी देर माता-पिता ने अनुमति दी है, और केवल उतने ही पैसों के साथ जो माता-पिता ने दिए हैं। यदि बच्चा सीमाओं से बाहर जाने की कोशिश करता है, तो सिस्टम उसे पकड़ लेता है। यह एक छोटी सी गलती को एक बड़ी आपदा में बदलने से रोकता है जहाँ एक एआई एजेंट गलती से डेटाबेस डिलीट कर सकता है क्योंकि उसे गलती से बहुत अधिक शक्ति दे दी गई थी।
"कॉन्फिडेंस" (विश्वास) डैशबोर्ड
एक अन्य प्रमुख विशेषता यह है कि सिस्टम कॉन्फिडेंस (Confidence) को कैसे संभालता है। अतीत में, एआई मॉडल केवल एक उत्तर देते थे, शायद एक छोटी संख्या के साथ कि वे कितने आश्वस्त थे। लेकिन पेपर का सुझाव है कि "कॉन्फिडेंस" एक वास्तविक नियंत्रण संकेत होना चाहिए, जैसे कि ट्रैफिक लाइट।
यदि सिस्टम 99% आश्वस्त है, तो लाइट हरी है: "आगे बढ़ें!"
यदि सिस्टम 80% आश्वस्त है लेकिन कार्य जोखिम भरा है (जैसे पैसा स्थानांतरित करना), तो लाइट पीली हो सकती है: "रुको, आइए किसी इंसान से दोबारा जाँच करवा लें।"
यदि सिस्टम 50% आश्वस्त है, तो लाइट लाल है: "रुकिए! हमें नहीं पता कि क्या हो रहा है।"
पेपर का सुझाव है कि सिस्टम में एक "कॉन्फिडेंस डैशबोर्ड" होना चाहिए जो कई चीजों को देखता है: क्या डेटा ताज़ा है? क्या टूल विश्वसनीय है? क्या योजना स्पष्ट है? इन सभी संकेतों के आधार पर, यह आगे बढ़ने, पुनः प्रयास करने या मदद के लिए इंसान को बुलाने का निर्णय लेता है।
यह पेपर क्या है (और क्या नहीं है)
यह समझना महत्वपूर्ण है कि यह पेपर वास्तव में क्या कर रहा है। लेखक यह नहीं कह रहे हैं कि उन्होंने अभी तक एक आदर्श एआई ऑपरेटिंग सिस्टम बना लिया है। वे यह दावा भी नहीं कर रहे हैं कि उनका सिस्टम बाहर मौजूद अन्य सभी चीजों से तेज़ या स्मार्ट है।
इसके बजाय, वे एक रेफरेंस आर्किटेक्चर (Reference Architecture) का प्रस्ताव कर रहे हैं। इसे एक नए प्रकार के घर के लिए ब्लूप्रिंट तैयार करने वाले वास्तुकार के रूप में समझें। वे घर नहीं बना रहे हैं; वे योजनाएँ बना रहे हैं ताकि विभिन्न निर्माण कंपनियाँ ऐसे घर बना सकें जिनमें एक ही सुरक्षित, मजबूत नींव हो।
पेपर स्पष्ट रूप से कुछ चीजों को खारिज करता है:
- यह कोई विशिष्ट उत्पाद नहीं है जिसे आप खरीद सकते हैं।
- यह आपके कंप्यूटर पर चलने वाले लिनक्स या विंडोज ऑपरेटिंग सिस्टम का प्रतिस्थापन नहीं है।
- यह कोई एकल प्रोग्रामिंग भाषा या विशिष्ट एआई मॉडल नहीं है।
- यह यह दावा नहीं करता कि यह अभी तक एआई की हर संभव समस्या को हल कर देता है।
लेखक बहुत स्पष्ट हैं कि यह एक प्रस्ताव और एक आधार है। वे सुझाव दे रहे हैं कि अराजकता को व्यवस्थित करने का एक तरीका क्या है ताकि भविष्य में हमारे पास भरोसेमंद, व्याख्या योग्य और सुरक्षित एआई सिस्टम हों। वे स्वीकार करते हैं कि अभी भी कई सवालों के जवाब देने बाकी हैं, जैसे कि विभिन्न देशों में विभिन्न नियमों को कैसे संभालें या यह कैसे सुनिश्चित करें कि "कॉन्फिडेंस" नंबर वास्तव में सटीक हैं।
बड़ी तस्वीर
तो, यह एक जिज्ञासु किशोर के लिए क्यों मायने रखता है? क्योंकि एआई का भविष्य केवल स्मार्ट चैटबॉट्स के बारे में नहीं है; यह उन एआई के बारे में है जो वास्तविक दुनिया में काम कर सकते हैं। यह उस एआई के बारे में है जो आपके स्मार्ट होम को प्रबंधित कर सकता है, डॉक्टरों को बीमारी का निदान करने में मदद कर सकता है, या जटिल व्यावसायिक संचालन चला सकता है।
यदि हमारे पास इन एजेंटों को प्रबंधित करने के लिए एक अच्छी प्रणाली नहीं है, तो हम एक ऐसी डिजिटल दुनिया का जोखिम उठाते हैं जहाँ रोबोट शक्तिशाली तो हैं लेकिन अप्रत्याशित हैं। AOS ब्लूप्रिंट सुझाव देता है कि "नियमों के बारे में सोचने" को "काम करने" से अलग करके, और इस बारे में बहुत सख्त होकर कि किसके पास क्या करने की अनुमति है, हम एक ऐसा भविष्य बना सकते हैं जहाँ एआई एजेंट अराजक अनिश्चितताओं के बजाय सहायक साथी हों।
पेपर समाप्त होता है यह कहते हुए कि यह तो बस शुरुआत है। उन्होंने नक्शा खींच दिया है, लेकिन वास्तविक सिस्टम बनाने की यात्रा अभी शुरू हुई है। वे अन्य शोधकर्ताओं और डेवलपरों को इन विचारों का उपयोग करने, इनका परीक्षण करने और सुरक्षित, शासित एआई के भविष्य को बनाने में मदद करने के लिए आमंत्रित करते हैं। यह अगली पीढ़ी के निर्माताओं के लिए एक आह्वान है ताकि यह सुनिश्चित किया जा सके कि हम जो डिजिटल दुनिया बना रहे हैं वह ऐसी हो जिस पर हम सभी भरोसा कर सकें।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।