← नवीनतम पेपर
💻 computer science

Agent Operating Systems (AOS): Integrating Agentic Control Planes into, and Beyond, Traditional Operating Systems

यह शोध पत्र एक एजेंट ऑपरेटिंग सिस्टम (AOS) की अवधारणा प्रस्तुत करता है, जो एक नया सिस्टम आर्किटेक्चर है जो संभाव्य (probabilistic), लक्ष्य-निर्देशित AI एजेंटों द्वारा उत्पन्न अद्वितीय शेड्यूलिंग, मेमोरी, सुरक्षा और गवर्नेंस की चुनौतियों को संबोधित करने के लिए पारंपरिक ऑपरेटिंग सिस्टम के भीतर या उनके साथ एजेंटिक कंट्रोल प्लेन को एकीकृत करता है, ताकि यह सुनिश्चित किया जा सके कि वे बड़े पैमाने पर नियंत्रणीय, जवाबदेह और सुरक्षित बने रहें।

मूल लेखक: Ankur Sharma, Deep Shah

प्रकाशित 2026-06-02
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Ankur Sharma, Deep Shah

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि एक पारंपरिक कंप्यूटर ऑपरेटिंग सिस्टम (जैसे विंडोज या लिनक्स) एक बहुत ही सख्त, नियमों का पालन करने वाला निर्माण प्रबंधक (construction manager) है।

यह प्रबंधक उन मानव श्रमिकों को संभालने में बहुत कुशल है जो एक स्पष्ट, लिखित ब्लूप्रिंट का पालन करते हैं। यदि कोई श्रमिक कहता है, "मुझे एक हथौड़ा चाहिए," तो प्रबंधक नियमों की जाँच करता है, देखता है कि श्रमिक के पास अनुमति है, और उसे हथौड़ा सौंप देता है। यदि कोई श्रमिक बिना परमिट के आरी (chainsaw) का उपयोग करने की कोशिश करता है, तो प्रबंधक कहता है "नहीं।" श्रमिक के कार्य पूर्वानुमानित, रैखिक और ट्रैक करने में आसान होते हैं।

समस्या: "AI एजेंट"
अब, एक नए प्रकार के श्रमिक को काम पर रखने की कल्पना करें: एक AI एजेंट। यह श्रमिक अलग है।

  • वे किसी निश्चित ब्लूप्रिंट का पालन नहीं करते; उनके पास एक लक्ष्य होता है (जैसे, "छुट्टियों की योजना बनाना")।
  • वे संभाव्यता (probabilistic) के आधार पर सोचते हैं (वे सबसे अच्छे रास्ते का अनुमान लगाते हैं)।
  • वे लंबे समय तक सक्रिय रह सकते हैं और कार्य के बीच में अपना निर्णय बदल सकते हैं।
  • वे बिना हर कदम पर अनुमति मांगे, खुद से एक ट्रैवल एजेंट को कॉल करने, होटल बुक करने और टिकट खरीदने का निर्णय ले सकते हैं।

पुराना "निर्माण प्रबंधक" (पारंपरिक OS) भ्रमित हो जाता है। वह देखता है कि AI श्रमिक घंटों तक खाली बैठा है (फ्लाइट उपलब्ध होने का इंतज़ार कर रहा है) और सोचता है कि वह आलसी है। वह यह नहीं समझ पाता कि श्रमिक "योजना बना रहा है।" उसे यह नहीं पता कि श्रमिक ने एक विशिष्ट होटल क्यों चुना, वह केवल यह जानता है कि उसने उसे खरीदा। यदि श्रमिक कोई गलती करता है, तो प्रबंधक उस विचार प्रक्रिया को आसानी से ट्रैक नहीं कर पाता जो उस गलती तक ले गई।

समाधान: एजेंट ऑपरेटिंग सिस्टम (AOS)
यह शोध पत्र प्रबंधन की एक नई परत प्रस्तावित करता है जिसे एजेंट ऑपरेटिंग सिस्टम (AOS) कहा जाता है। इसे एक विशेषज्ञ "लक्ष्य-प्रबंधक" (Goal-Manager) के रूप में समझें जो निर्माण प्रबंधक के ऊपर स्थित है।

यहाँ AOS कैसे काम करता है, सरल उपमाओं का उपयोग करते हुए:

1. तीन-टीम संरचना (प्लेन का पृथक्करण)

AOS चीजों को सुरक्षित रखने के लिए काम को तीन अलग-अलग टीमों में विभाजित करता है:

  • ड्रीम टीम (तर्क प्लेन - Reasoning Plane): यह स्वयं AI है। यह रचनात्मक है, अनुमान लगाता है और योजनाएं बनाता है। महत्वपूर्ण रूप से, AOS इस टीम को "अविश्वसनीय" (untrusted) मानता है। वे केवल विचार प्रस्तावित कर सकते हैं, उन्हें निष्पादित नहीं कर सकते।
  • बाउंसर (पॉलिसी प्लेन - Policy Plane): यह नियम बनाने वाला है। यह ड्रीम टीम के प्रस्तावों को देखता है और पूछता है, "क्या यह अनुमत है? क्या यह सुरक्षित है? क्या हमारे पास बजट है?" यह सख्त नियमों के आधार पर एक स्पष्ट हाँ/नहीं का निर्णय लेता है।
  • काम करने वाले (एक्जीक्यूशन प्लेन - Execution Plane): ये वे कार्यकर्ता हैं जो वास्तव में काम करते हैं। वे तभी कार्य करते हैं जब बाउंसर "हाँ" कहता है। वे एक सैंडबॉक्स (एक सुरक्षित, प्रतिबंधित क्षेत्र) के भीतर लॉक होते हैं ताकि वे गलती से कुछ भी तोड़ न सकें।

2. नए पद (प्रथम श्रेणी की संस्थाएं - First-Class Entities)

एक सामान्य कंप्यूटर में, OS "प्रोसेस" (जैसे एक चलता हुआ प्रोग्राम) को ट्रैक करता है। AOS नए जॉब टाइटल पेश करता है:

  • एजेंट पहचान (Agent Identity): AI श्रमिक के लिए एक विशिष्ट आईडी कार्ड।
  • गोल ग्राफ्स (Goal Graphs): श्रमिक के वर्तमान मिशन और उसके चरणों का एक मानचित्र।
  • क्षमताएं (Capabilities): उन विशिष्ट उपकरणों की एक सूची जिन्हें श्रमिक छू सकता है (जैसे, "ईमेल पढ़ सकता है, लेकिन उन्हें हटा नहीं सकता")।
  • निष्पादन रिकॉर्ड (Execution Records): लिए गए प्रत्येक निर्णय की एक स्थायी, अपरिवर्तनीय डायरी।

3. "टूल" बनाम "सिस्टम कॉल"

एक सामान्य कंप्यूटर में, एक प्रोग्राम OS से फ़ाइल खोलने के लिए कहता है। AOS में, AI एक टूल (जैसे "फ्लाइट बुक करना") का उपयोग करने के लिए कहता है।

  • AOS इसे एक उच्च-सुरक्षा चेकपॉइंट की तरह मानता है।
  • टूल का उपयोग करने से पहले, बाउंसर जाँच करता है: "क्या यह टूल अनुमत है? क्या गंतव्य सुरक्षित है? क्या कीमत बजट के भीतर है?"
  • यदि AI बाउंसर को चकमा देकर टूल चलाने की कोशिश करता है (जैसे सीधे ट्रैवल एजेंट को कॉल करना), तो AOS इसे ब्लॉक कर देता है।

4. मेमोरी और कॉन्टेक्स्ट

सामान्य कंप्यूटर चीजें फ़ाइलें सहेजकर याद रखते हैं। AI एजेंट चीजों को याद रखने के लिए अपने "कॉन्टेक्स्ट विंडो" (अल्पकालिक स्मृति) और "दीर्घकालिक स्मृति" का उपयोग करते हैं।
AOS इसे एक लाइब्रेरियन (Librarian) की तरह प्रबंधित करता है। यह केवल पुस्तक को संग्रहीत नहीं करता है; यह इसे टैग करता है:

  • यह जानकारी कहाँ से आई? (Provenance/स्रोत)
  • क्या यह जानकारी भरोसेमंद है? (Trust level/विश्वास स्तर)
  • इस जानकारी को कब फेंक दिया जाना चाहिए? (Retention rules/प्रतिधारण नियम)
    यह सुनिश्चित करता है कि यदि कोई एजेंट गलत निर्णय लेता है, तो आप देख सकते हैं कि एजेंट ने गलती करने के समय किस जानकारी को देख रहा था।

5. "ब्लैक बॉक्स" की समस्या

AI तर्क अक्सर एक "ब्लैक बॉक्स" होता है (हम नहीं जानते कि वह वास्तव में कैसे सोचता है)। शोध पत्र स्वीकार करता है कि हम AI के मस्तिष्क को 100% पूर्वानुमानित बनाने के लिए ठीक नहीं कर सकते।
AOS की तरकीब: यह AI की सोच को पूर्वानुमानित बनाने की कोशिश नहीं करता। इसके बजाय, यह AI के कार्यों को पूर्वानुमानित बनाता है।

  • मस्तिष्क के अंदर: अराजकता और संभाव्यता ठीक है।
  • दरवाजे पर (सीमा): सब कुछ एक नियतात्मक (deterministic - सख्त, अपरिवर्तनीय) नियम सेट द्वारा जांचा, लॉग किया और अनुमोदित किया जाना चाहिए।

6. यह मौजूदा कंप्यूटरों के साथ कैसे फिट होता है

शोध पत्र स्पष्ट करता है कि AOS विंडोज या लिनक्स को प्रतिस्थापित नहीं करता है।

  • लिनक्स/विंडोज अभी भी आधार (हार्डवेयर, मेमोरी, बुनियादी सुरक्षा) हैं।
  • AOS सॉफ़्टवेयर की एक नई परत है जो उनके ऊपर स्थित है, जो AI एजेंटों के लिए एक कंट्रोल टॉवर के रूप में कार्य करती है।
  • यह आपके वर्तमान कंप्यूटर (यूज़र-स्पेस) पर या पूरे नेटवर्क के कंप्यूटरों के माध्यम से वितरित (distributed) रूप में चल सकता है।

सारांश

शोध पत्र का तर्क है कि हम AI एजेंटों को सामान्य सॉफ़्टवेयर की तरह नहीं चला सकते। वे बहुत अलग हैं। हमें एक नए "ऑपरेटिंग सिस्टम" की आवश्यकता है जो एक सख्त पर्यवेक्षक के रूप में कार्य करे। यह पर्यवेक्षक यह सुनिश्चित करता है कि भले ही AI रचनात्मक और अप्रत्याशित हो, लेकिन उसके कार्य सुरक्षित, लॉग किए गए और मानव-निर्धारित नियमों द्वारा सख्ती से नियंत्रित हों। यह AI को एक "विद्रोही कर्मचारी" से बदलकर एक "प्रबंधित, जवाबदेह कार्यकर्ता" में बदल देता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →