← नवीनतम पेपर
🤖 AI

DoubleAgents: Human-Agent Alignment in a Socially Embedded Workflow

DoubleAgents एक ऐसा सिस्टम है जो एक समन्वय एजेंट (coordination agent), एक सुस्पष्ट डैशबोर्ड (legible dashboard) और एक नीति मॉड्यूल (policy module) को एकीकृत करके सामाजिक रूप से अंतर्निहित वर्कफ़्लो में एजेंटिक AI को उपयोगकर्ता के इरादे के साथ संरेखित करता है, जिससे उपयोगकर्ता के संपादन को पुन: प्रयोज्य आर्टिफ़ैक्ट्स में बदलकर उपयोगकर्ता के विश्वास और निर्भरता को बढ़ाया जाता है और साथ ही एज केस (edge cases) पर आवश्यक मानवीय नियंत्रण भी सुरक्षित रखा जाता है।

मूल लेखक: Tao Long, Xuanming Zhang, Sitong Wang, Zhou Yu, Lydia B Chilton

प्रकाशित 2026-04-07
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Tao Long, Xuanming Zhang, Sitong Wang, Zhou Yu, Lydia B Chilton

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक विश्वविद्यालय सेमिनार श्रृंखला के आयोजक हैं। आपका काम चार अलग-अलग तारीखों पर चार प्रसिद्ध प्रोफेसरों को बोलने के लिए आमंत्रित करना है। सुनने में यह सरल लगता है? वास्तव में, यह ईमेल, टाइम ज़ोन, व्यक्तित्व के टकराव और "शायद मैं आ सकूँ" जैसे जवाबों का एक दुःस्वप्न है जो कभी "हाँ" में नहीं बदलते।

यदि आप इसे अकेले करने की कोशिश करते हैं, तो आप लोगों के पीछे भागते हुए हफ्तों बिता देंगे। यदि आप बस एक मानक AI को "यह करो" कहते हैं, तो यह किसी व्यस्त प्रोफेसर को एक अभद्र ईमेल भेज सकता है या फॉलो-अप करना भूल सकता है, जिससे आपकी प्रतिष्ठा खराब हो सकती है।

DoubleAgents से मिलिए। इसे एक ऐसे रोबोट के रूप में न देखें जो आपकी नौकरी छीन रहा है, बल्कि एक सुपर-स्मार्ट को-पायलट के रूप में देखें जो आपके उड़ने के विशिष्ट तरीके को सीखता है ताकि अंततः आप इसे ऑटोपायलट संभालने के लिए छोड़ सकें।

यह कैसे काम करता है, यहाँ सरल अवधारणाओं में दिया गया है:

1. समस्या: AI का "ब्लैक बॉक्स"

आमतौर पर, जब आप AI से कुछ करने के लिए कहते हैं, तो यह एक जादुई बॉक्स की तरह होता है। आप एक अनुरोध डालते हैं, और एक ईमेल बाहर आता है। लेकिन आपको नहीं पता कि उसने वह ईमेल क्यों लिखा, या क्या वह बहुत अधिक दबाव डाल रहा है। यदि AI कोई गलती करता है, तो आपको उसे ठीक करना पड़ता है, लेकिन आपको यह नहीं पता कि AI को "अगली बार ऐसा न करें" कैसे कहें बिना सब कुछ फिर से शुरू किए।

DoubleAgents इसे इस प्रकार बदल देता है कि यह AI अलाइनमेंट को साइकिल चलाने सीखने वाले ट्रेनिंग व्हील्स की तरह मानता है। आप सिर्फ कूदकर उम्मीद नहीं करते कि सब ठीक होगा; आप अभ्यास करते हैं, लड़खड़ाते हैं, सुधार करते हैं, और अंततः आप इस पर भरोसा करते हैं कि वह अपने आप साइकिल चला सके।

2. तीन जादुई उपकरण (द "डिस्ट्रीब्यूटेड कॉग्निशन" ट्रायो)

यह पेपर एक फैंसी शब्द "डिस्ट्रीब्यूटेड कॉग्निशन" का उपयोग करता है, जिसका मूल रूप से अर्थ है मानसिक भार को साझा करना। DoubleAgents इसे तीन विशिष्ट उपकरणों के साथ करता है:

A. "मेमोरी और ब्रेन" (द कोऑर्डिनेशन एजेंट)

कल्पना कीजिए कि आपके पास एक बहुत ही व्यवस्थित सहायक है जो कुछ भी नहीं भूलता।

  • यह क्या करता है: यह ट्रैक रखता है कि आपने किसे ईमेल किया है, किसने उत्तर दिया है, कौन प्रतीक्षा कर रहा है, और वर्तमान तारीख क्या है।
  • उपमा: यह आपके सेमिनार के लिए एक फ्लाइट रिकॉर्डर की तरह है। इसे पता है कि विमान कहाँ है, कितना ईंधन बचा है, और अगला कदम क्या होना चाहिए, ताकि आपको वह सारी जानकारी अपने दिमाग में न रखनी पड़े।

B. "ग्लास डैशबोर्ड" (द विज़ुअलाइज़ेशन)

आमतौर पर, AI की तर्क प्रक्रिया अंधेरे में होती है। DoubleAgents आपके सामने एक ग्लास डैशबोर्ड रखता है।

  • यह क्या करता है: यह आपको एक कैलेंडर, उन लोगों की सूची जिन्होंने उत्तर दिया है, और भेजे गए प्रत्येक ईमेल का लॉग दिखाता है। सबसे महत्वपूर्ण बात यह है कि यह बताता है कि AI अगला ईमेल क्यों भेजना चाहता है।
  • उपमा: एक कॉकपिट के बारे में सोचें। पायलट (आप) को इंजन के कच्चे कोड को देखने की आवश्यकता नहीं है; उन्हें ऊंचाई, गति और ईंधन गेज देखने की आवश्यकता है। यह डैशबोर्ड आपको AI की "विचार प्रक्रिया" को एक नज़र में देखने देता है ताकि आप कह सकें, "हाँ, यह सही लग रहा है," या "रुको, यह बहुत अधिक दबाव डालने वाला है।"

C. "रूल बुक" (द पॉलिसी मॉड्यूल)

यह सबसे महत्वपूर्ण हिस्सा है। केवल एक गलती को ठीक करने के बजाय, आप AI को एक नियम सिखाते हैं ताकि वह दोबारा वह गलती न करे।

  • यह क्या करता है: यदि AI एक बहुत ही औपचारिक ईमेल भेजता है, तो आप उसे संपादित करते हैं। सिस्टम फिर एक नियम लिखता है: "दोस्त को ईमेल करते समय, अनौपचारिक लहजे का उपयोग करें।" यदि कोई प्रोफेसर ज़ूम कॉल के लिए कहता है और AI को नहीं पता कि क्या करना है, तो वह रुक जाता है और आपसे पूछता है। आप कहते हैं, "ज़ूम ठीक है," और सिस्टम एक नियम जोड़ता है: "यदि अनुरोध किया जाए तो ज़ूम की अनुमति दें।"
  • उपमा: इसे कुत्ते को प्रशिक्षित करने जैसा समझें। यदि कुत्ता सोफे पर कूदता है, तो आप कहते हैं "नहीं"। यदि आप केवल उसे नीचे धकेल देते हैं, तो वह फिर से कूद सकता है। लेकिन यदि आप उसे "कूदने का नियम" सिखाते हैं, तो वह सिद्धांत को सीख जाता है। DoubleAgents आपकी सुधारों को एक स्थायी "रूल बुक" में बदल देता है जिसे AI हर बार कार्य करते समय पढ़ता है।

3. "सिमुलेशन जिम"

इससे पहले कि आप AI को वास्तविक, प्रसिद्ध प्रोफेसरों से बात करने दें, आप इसे एक सिमुलेशन जिम में अभ्यास करने देते हैं।

  • यह कैसे काम करता है: सिस्टम नकली प्रोफेसर (AI व्यक्तित्व) बनाता है जो वास्तविक लोगों की तरह व्यवहार करते हैं। कुछ गुस्सैल होते हैं, कुछ धीरे जवाब देते हैं, और कुछ अजीब चीजें मांगते हैं (जैसे "क्या मैं ज़ूम के माध्यम से प्रस्तुत कर सकता हूँ?")।
  • लाभ: आप केवल मिनटों में हफ्तों का समन्वय देख सकते हैं। आप देख सकते हैं कि AI गलतियाँ करता है, उन्हें ठीक करता है, और वास्तविक ईमेल भेजने से पहले 'रूल बुक' को अपडेट करता है। यह पायलटों के लिए फ्लाइट सिम्युलेटर की तरह है—आप सिम्युलेटर में क्रैश होते हैं ताकि आप वास्तविक जीवन में क्रैश न हों।

4. परिणाम: विश्वास और स्वतंत्रता

अध्ययन ने दिखाया कि जैसे-जैसे लोगों ने इस प्रणाली का उपयोग किया:

  1. वे अधिक सहज हो गए: उन्होंने AI पर ईमेल ड्राफ्ट करने और मीटिंग शेड्यूल करने के लिए भरोसा करना शुरू कर दिया।
  2. उन्होंने नियंत्रण नहीं खोया: AI "एज केसेस" (अजीब स्थितियों) पर रुक जाता था और अनुमति मांगता था। इसने उपयोगकर्ताओं को सुरक्षित महसूस कराया क्योंकि वे जानते थे कि AI उनके बिना कुछ भी पागलपन भरा नहीं करेगा।
  3. उन्होंने एक विरासत बनाई: अंत तक, उपयोगकर्ता के पास एक व्यक्तिगत "रूल बुक" और ईमेल टेम्पलेट थे जिन्हें वे भविष्य के सेमिनार के लिए उपयोग कर सकते थे, जिससे अगली बार काम और भी आसान हो गया।

निचोड़

DoubleAgents मनुष्यों को रोबोट से बदलने के बारे में नहीं है। यह रोबोटों को आपके विशिष्ट प्रकार के इंसान बनने के लिए सिखाने के बारे में है।

यह AI की डरावनी, अप्रत्याशित दुनिया को एक सहयोगात्मक साझेदारी में बदल देता है जहाँ:

  • AI उबाऊ मेमोरी का काम संभालता है।
  • आप निर्णय और "ओह, यह बहुत रूखा था" वाले क्षणों को संभालते हैं।
  • मिलकर, आप नियमों का एक सेट बनाते हैं जो AI को स्मार्ट बनाता है और हर बार आपके मूल्यों के साथ बेहतर तालमेल बिठाता है।

यह अपने जीवन को व्यवस्थित करने के लिए एक अजनबी को काम पर रखने और एक व्यक्तिगत सहायक को काम पर रखने के बीच का अंतर है जिसे वर्षों तक आपके द्वारा प्रशिक्षित किया गया है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →