← नवीनतम पेपर
💬 NLP

Securing Computer-Use Agents: A Unified Architecture-Lifecycle Framework for Deployment-Grounded Reliability

यह शोध पत्र कंप्यूटर-उपयोग एजेंटों की परिनियोजन-आधारित विश्वसनीयता को बढ़ाने के लिए एक एकीकृत आर्किटेक्चर-लाइफसाइकिल फ्रेमवर्क प्रस्तावित करता है, जो उनके धारणा-निर्णय-निष्पादन स्तरों को निर्माण-परिनियोजन-संचालन-रखरखाव चरणों के साथ व्यवस्थित रूप से जोड़कर अधिकार जोखिम (authority exposure), विफलता मोड और नियंत्रण निरीक्षण को बेहतर ढंग से प्रबंधित करता है।

मूल लेखक: Zejian Chen, Zhanyuan Liu, Chaozhuo Li, Mengxiang Han, Songyang Liu, Litian Zhang, Feng Gao, Yiming Hei, Xi Zhang

प्रकाशित 2026-05-11
📖 7 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Zejian Chen, Zhanyuan Liu, Chaozhuo Li, Mengxiang Han, Songyang Liu, Litian Zhang, Feng Gao, Yiming Hei, Xi Zhang

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आपने एक बहुत ही बुद्धिमान, सुपर-फास्ट डिजिटल सहायक (डिजिटल असिस्टेंट) को काम पर रखा है। यह सहायक आपकी कंप्यूटर स्क्रीन देख सकता है, आपकी जरूरतों को समझ सकता है, और आपके लिए बटन क्लिक कर सकता है, कमांड टाइप कर सकता है, और फाइलें भी मूव कर सकता है। इसे ही यह पेपर कंप्यूटर-यूज़ एजेंट (CUA) कहता है।

अतीत में, हमने इन सहायकों का परीक्षण एक "सैंडबॉक्स" में किया था—एक सुरक्षित, नकली वातावरण जहाँ अगर वे कोई गलती करते, तो उन्हें बस एक टेस्ट में खराब ग्रेड मिलता। लेकिन अब, ये सहायक वास्तविक दुनिया में कदम रख रहे हैं। वे आपके बैंक में लॉग-इन कर रहे हैं, आपके ईमेल मैनेज कर रहे हैं, और फाइलें डिलीट कर रहे हैं। वास्तविक दुनिया में, एक गलती का मतलब सिर्फ एक खराब ग्रेड नहीं है; यह एक डिलीट की गई फोटो, एक लीक हुआ पासवर्ड, या गलत व्यक्ति को पैसे ट्रांसफर करना हो सकता है।

यह पेपर तर्क देता है कि इन सहायकों को सुरक्षित और विश्वसनीय बनाए रखने के लिए, हम केवल यह नहीं देख सकते कि वे कितने "स्मार्ट" हैं। हमें उन्हें देखने का एक नया तरीका चाहिए जो इस बात को जोड़ता हो कि उन्हें कैसे बनाया गया है और समय के साथ उनका उपयोग कैसे किया जाता है

यहाँ इस पेपर का मुख्य विचार है, जिसे सरल उपमाओं (analogies) में तोड़कर समझाया गया है:

1. दो-भागों वाला मानचित्र: आर्किटेक्चर और लाइफसाइकिल (जीवनचक्र)

लेखक कहते हैं कि इन एजेंटों को समझने के लिए हमें दो आयामों वाले एक मानचित्र की आवश्यकता है:

  • आर्किटेक्चर (The Architecture - "शरीर"): एजेंट कैसे बनाया गया है।
  • लाइफसाइकिल (The Lifecycle - "जीवन की कहानी"): कैसे एक एजेंट छात्र से एक कर्मचारी और फिर एक वृद्ध कर्मचारी में बदल जाता है।

आर्किटेक्चर: तीन-परतीय मस्तिष्क (The Three-Layer Brain)

एजेंट को एक मानव शरीर की तरह तीन जुड़े हुए स्तरों के रूप में सोचें:

  1. परसेप्शन (Perception - "आंखें"): यह वह तरीका है जिससे एजेंट स्क्रीन को देखता है। क्या वह बटनों के पीछे के कोड को पढ़ रहा है (एक प्रोग्रामर की तरह), या केवल स्क्रीन की एक तस्वीर देख रहा है (एक इंसान की तरह)? यदि उसकी "आंखें" धुंधली हैं, तो वह गलत बटन क्लिक कर सकता है।
  2. डिसीजन (Decision - "मस्तिष्क"): यहाँ एजेंट योजना बनाता है। यदि आप उससे "एक रिपोर्ट लिखने" के लिए कहते हैं, तो क्या उसे याद रहता है कि जब तक आप न कहें तब तक उसे भेजना नहीं है? क्या वह 50 स्टेप्स के बाद भ्रमित हो जाता है? यह परत तय करती है कि आगे क्या करना है।
  3. एक्जीक्यूशन (Execution - "हाथ"): यहाँ एजेंट वास्तव में कार्य करता है। वह क्लिक करता है, टाइप करता है, या कोड चलाता है। पेपर चेतावनी देता है कि "हाथ" खतरनाक हो सकते हैं। यदि एजेंट के पास "सुपर-स्ट्रेंथ" (उच्च अधिकार/authority) है, तो "आंखों" या "मस्तिष्क" की एक छोटी सी गलती एक बड़ी आपदा का कारण बन सकती है।

लाइफसाइकिल: जीवन के चार चरण (The Four Stages of Life)

पेपर कहता है कि आप केवल एजेंट को तब नहीं देख सकते जब वह काम कर रहा हो। आपको उसके पूरे जीवन को देखना होगा:

  1. क्रिएशन (Creation - "स्कूल"): यह वह समय है जब एजेंट को प्रशिक्षित (train) किया जा रहा है। यदि वह यहाँ बुरी आदतें सीख लेता है (जैसे "हमेशा सबसे बड़ा बटन क्लिक करो" या "कभी अनुमति मत मांगो"), तो वह उन बुरी आदतों को हमेशा के लिए ढोएगा।
  2. डिप्लॉयमेंट (Deployment - "नौकरी पाना"): यह वह समय है जब एजेंट को अपना आईडी कार्ड और चाबियाँ मिलती हैं। पेपर कहता है कि यह सबसे महत्वपूर्ण क्षण है। यदि आप एक नए कर्मचारी को केवल एक ऑफिस की चाबियाँ देने के बजाय पूरी इमारत की चाबियाँ दे देते हैं (बहुत अधिक अनुमति), तो एक गलती सब कुछ बर्बाद कर सकती है।
  3. ऑपरेशन (Operation - "काम पर"): यह वास्तविक समय में काम करने वाला एजेंट है। काम करते समय दुनिया बदलती रहती है। एक विंडो पॉप-अप हो सकती है, एक फाइल हिल सकती है, या कोई हैकर उसे धोखा दे सकता है। एजेंट को केंद्रित रहना चाहिए और अपने काम से भटकना नहीं चाहिए।
  4. मेंटेनेंस (Maintenance - "बड़ा होना"): सॉफ्टवेयर अपडेट, वेबसाइटों का डिज़ाइन बदल जाता है, और नए टूल्स आते हैं। यदि एजेंट को अपडेट या दोबारा चेक नहीं किया गया, तो वह अजीब व्यवहार कर सकता है या असुरक्षित हो सकता है क्योंकि उसके आसपास की दुनिया बदल गई है।

2. बड़ी अंतर्दृष्टि: "समस्या कहाँ से शुरू हुई?"

पेपर का सबसे महत्वपूर्ण बिंदु यह है कि आज आप जो समस्या देखते हैं, वह वर्षों पहले शुरू हुई हो सकती है।

  • रूपक (Metaphor): कल्पना कीजिए कि एक कार दुर्घटना होती है।
    • दुर्घटना (Operation): कार एक पेड़ से टकरा जाती है।
    • कारण: क्या ड्राइवर नशे में था? (खराब प्रशिक्षण/Creation)। क्या किसी ने उन्हें कार के बजाय ट्रक की चाबियाँ दे दी थीं? (खराब अनुमतियाँ/Deployment)। क्या ब्रेक फेल हो गए क्योंकि मैकेनिक ने पिछले महीने उनकी जांच नहीं की थी? (खराब मेंटेनेंस/Maintenance)।

पेपर कहता है कि हम अक्सर "दुर्घटना" (काम करते समय एजेंट द्वारा गलती करना) को दोष देते हैं, लेकिन हमें इसे ठीक करने के लिए क्रिएशन (खराब प्रशिक्षण) या डिप्लॉयमेंट (खराब अनुमतियाँ) को देखना चाहिए।

3. सुरक्षा के नियम (Security Rules)

लेखक सुझाव देते हैं कि इन एजेंटों को सुरक्षित रखने के लिए, हमें एक "डिफेंस स्टैक" बनाना चाहिए जो सभी चरणों को कवर करे:

  • स्कूल में (Creation): एजेंट को सावधान रहना सिखाएं। उसे केवल तेजी से काम पूरा करने के लिए पुरस्कृत न करें; उसे सुरक्षित रहने के लिए पुरस्कृत करें।
  • नौकरी पाते समय (Deployment): उसे "न्यूनतम विशेषाधिकार" (Least Privilege) दें। यदि उसे केवल एक ईमेल खोलने की आवश्यकता है, तो उसे सर्वर रूम की चाबियाँ न दें।
  • काम पर (Operation): एक "ह्यूमन इन द लूप" (Human in the Loop) रखें। एजेंट द्वारा कुछ भी खतरनाक करने से पहले (जैसे पैसे भेजना), उसे रुकना चाहिए और एक इंसान से पूछना चाहिए: "क्या आप सुनिश्चित हैं?"
  • बड़ा होते समय (Maintenance): एजेंट की जांच करते रहें। यदि वह वेबसाइट जिसका वह उपयोग करता है उसका लेआउट बदल जाता है, तो एजेंट को फिर से प्रशिक्षित करने की आवश्यकता है ताकि वह भ्रमित न हो।

4. "OpenClaw" नोट

पेपर में "OpenClaw" नामक एक सिस्टम का उल्लेख किया गया है जो यह दिखाने के उदाहरण के रूप में है कि ये एजेंट वास्तविक दुनिया में कैसे तैनात किए जा रहे हैं (जैसे कि आपके टूल्स तक पहुंच वाला एक लोकल असिस्टेंट)। हालांकि, लेखक सावधानी बरतते हुए कहते हैं: "हम यह नहीं कह रहे हैं कि OpenClaw परफेक्ट है या हमने इसका गहराई से परीक्षण किया है।" वे केवल इसे एक कहानी के रूप में उपयोग करते हैं कि क्या होता है जब आप एक एजेंट को वास्तविक टूल्स और अनुमतियों से जोड़ते हैं।

सारांश

पेपर निष्कर्ष निकालता है कि इन एजेंटों को विश्वसनीय बनाना केवल उन्हें स्मार्ट बनाने के बारे में नहीं है। यह है:

  1. उन्हें सही ढंग से बनाना (अच्छी आंखें और मस्तिष्क)।
  2. उन्हें सही मात्रा में शक्ति देना (बहुत अधिक चाबियाँ नहीं)।
  3. काम करते समय उन पर करीब से नज़र रखना।
  4. दुनिया बदलने के साथ उन्हें अपडेट करना।

यदि हम केवल इस बात पर ध्यान केंद्रित करते हैं कि एजेंट कितना स्मार्ट है, तो हम इस तथ्य को अनदेखा कर देते हैं कि गलत चाबियों और बुरी आदतों वाला एक स्मार्ट एजेंट आपदा का नुस्खा है। हमें एजेंट के केवल उसके टेस्ट स्कोर को नहीं, बल्कि उसके पूरे "जीवन" को प्रबंधित करने की आवश्यकता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →