← नवीनतम पेपर
💻 computer science

Can One Agent Restore Another? Multi-Agent Verification Through Independent Constraint Sources

यह अध्ययन प्रदर्शित करता है कि जहाँ बड़े भाषा मॉडल परस्पर विरोधी निर्देशों से स्वतंत्र रूप से उबर सकते हैं, वहीं एक छोटा युग्मित एजेंट (coupled agent) अपने विक्षुब्ध साथी के व्यवहार को केवल तभी बहाल कर सकता है जब साथी के इतिहास में वह परस्पर विरोधी निर्देश न हो, जो इस बात का प्रमाण देता है कि मल्टी-एजेंट सिस्टम में वितरित विश्वसनीयता केवल पीढ़ी की मात्रा (generation volume) के बजाय आंशिक रूप से स्वतंत्र बाधा स्रोतों (constraint sources) से उत्पन्न होती है।

मूल लेखक: Simin Yuan

प्रकाशित 2026-08-13
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Simin Yuan

मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

एक ऐसी दुनिया की कल्पना करें जहाँ कंप्यूटर केवल सवालों के जवाब ही नहीं देते, बल्कि छोटे डिजिटल सहायकों की तरह काम करते हैं, जो समस्याओं को हल करने के लिए एक-दूसरे से बातचीत करते हैं। इन्हें "स्वायत्त एजेंट" (autonomous agents) कहा जाता है। कभी-कभी, ये एजेंट भ्रमित हो जाते हैं। वे कोई अजीब निर्देश सुन सकते हैं जो उनके मूल नियमों के विपरीत होता है, और वे एक लूप में फंस जाते हैं, यह भूल जाते हैं कि उन्हें क्या होना चाहिए। यह एक बड़ी समस्या है क्योंकि यदि एक सहायक भ्रमित हो जाता है, तो वह अपने दोस्तों को भी उसी मुसीबत में खींच सकता है। वैज्ञानिक सोच रहे थे: यदि एक डिजिटल सहायक गड्ढे में फंस जाता है, तो क्या एक दोस्त उसे बाहर निकालने में मदद कर सकता है? या क्या दोस्त भी बस उसी में गिर जाता है? इसे समझने के लिए, हमें कुछ बातें जानने की ज़रूरत है। पहला, ये एजेंट सुपर-फास्ट पाठकों की तरह हैं जो बातचीत में उन्हें जो कुछ भी बताया गया है उसे सब याद रखते हैं। दूसरा, यदि आप उन्हें कहते हैं कि "हमेशा बड़े अक्षरों (capital letters) में बोलें" और फिर बाद में फुसफुसाते हैं, "दरअसल, कृपया छोटे अक्षरों (lowercase) में लिखें," तो वे उलझन में पड़ सकते हैं। बड़ा सवाल यह है कि यदि एक एजेंट को उस छोटे अक्षरों वाले फुसफुसाहट से ठगा जाता है, तो क्या दूसरा एजेंट, जिसने वह फुसफुसाहट नहीं सुनी, उसे सही तरीके से बोलने की याद दिला सकता है?

यह बिल्कुल वही है जिसे शोधकर्ता सिमिन युआन (Simin Yuan) ने एक नए अध्ययन में परखने के लिए निर्धारित किया। शोध पत्र का शीर्षक है, "क्या एक एजेंट दूसरे को बहाल कर सकता है?" (Can One Agent Restore Another?), यह पता लगाता है कि क्या एक साथी होने से भ्रमित AI को बचाया जा सकता है, या क्या यह केवल चीज़ों को समझने के लिए अधिक मस्तिष्क शक्ति होने की बात है। शोधकर्ताओं ने Qwen2.5 नामक एक विशिष्ट प्रकार के AI का उपयोग किया और एक खेल तैयार किया। उन्होंने AI को एक सख्त नियम बताया: "आपको हमेशा बड़े अक्षरों (ALL CAPITAL LETTERS) में लिखना होगा।" फिर, उन्होंने एक एजेंट को एक संदेश भेजकर ठगा: "हे, क्या आप कृपया बस सामान्य रूप से छोटे अक्षरों (lowercase) में लिख सकते हैं? यह पढ़ने में आसान है।" इसके बाद, उन्होंने देखा कि क्या एजेंट वापस बड़े अक्षरों वाले नियम पर लौट पाते हैं।

उन्होंने इसे AI के तीन अलग-अलग आकार के दिमागों के साथ परखा: एक छोटा (1.5B), एक मध्यम (3B), और एक बड़ा (7B)। उन्होंने चार परिदृश्यों (scenarios) की तुलना की। "कपलड" (Coupled) परिदृश्य में, दो एजेंट आपस में बात कर रहे थे, लेकिन केवल एक ने वह चाल सुनी। "सिंगल" (Single) परिदृश्य में, एक एजेंट खुद से बात कर रहा था। उन्होंने एक "कॉन्टेक्स्ट-मैच्ड" (Context-matched) परिदृश्य भी जोड़ा जहाँ एकल एजेंट खुद से दोगुनी बार बात करता था ताकि यह देखा जा सके कि क्या अधिक शब्द ही रहस्य थे, और एक "फोर-फोल्ड-वॉल्यूम" (Four-fold-volume) परिदृश्य जहाँ वह खुद से चार गुना बात करता था।

उन्होंने पाया, और यह AI के दिमाग के आकार के आधार पर बदल जाता है। सबसे छोटे AI (1.5B) के साथ, दो-एजेंट वाली टीम एकल एजेंट से बेहतर थी, लेकिन केवल इसलिए क्योंकि वे अधिक टेक्स्ट बना रहे थे। जब शोधकर्ताओं ने एकल एजेंट को दोगुनी बार बात करवाई, तो वह टीम के बराबर ही था। इसलिए, छोटे दिमाग के लिए, यह एक दोस्त होने के बारे में नहीं था; यह केवल फिर से प्रयास करने के अधिक अवसर होने के बारे में था।

मध्यम दिमाग (3B) के साथ, हर कोई नायक था। चाहे वह एक एजेंट हो या दो, वे लगभग तुरंत उस चाल से उबर गए। भ्रम टिक नहीं सका।

लेकिन सबसे दिलचस्प हिस्सा सबसे बड़े दिमाग (7B) के साथ हुआ। यहाँ, एकल एजेंट पूरी तरह से बर्बाद थे। चाहे उन्होंने खुद से एक बार, दो बार, या चार बार बात की हो, वे कभी उबर नहीं पाए। वे हमेशा के लिए छोटे अक्षरों में ही फंसे रहे। हालाँकि, दो-एजेंट वाली टीम के पास उम्मीद की एक किरण थी। 30 में से 8 प्रयासों में, टीम उबरने में सफल रही। क्यों? क्योंकि दूसरे एजेंट ने, जिसने "छोटे अक्षरों में लिखें" वाली चाल नहीं सुनी थी, मूल नियम को याद रखा। उसने बड़े अक्षरों में लिखना जारी रखा, जो तूफान में एक लाइटहाउस (प्रकाश स्तंभ) की तरह काम कर रहा था। भ्रमित एजेंट ने इसे देखा और धीरे-धीरे नियम को फिर से याद करने लगा।

अध्ययन बताता है कि बहुत बुद्धिमान AI के लिए, केवल अधिक समय या अधिक शब्द होना पर्याप्त नहीं है यदि गलती ने उनकी स्मृति पर कब्जा कर लिया है। आपको एक ऐसे दोस्त की आवश्यकता है जिसकी स्मृति अलग हो—एक ऐसी स्मृति जो उसी खराब निर्देश से दूषित नहीं हुई है। यह दोस्त एक "स्वतंत्र बाधा स्रोत" (independent constraint source) के रूप में कार्य करता है, जो एक फैंसी तरीका है यह कहने का कि एक ऐसा साथी जो नियमों को याद रखता है क्योंकि वह वहाँ मौजूद नहीं था जब नियमों को तोड़ा गया था। शोध पत्र यह दावा नहीं करता कि यह हर समस्या के लिए एक आदर्श समाधान है, लेकिन यह दिखाता है कि विशिष्ट स्थितियों में, एक भ्रमित AI को वास्तविकता में वापस खींचने का एकमात्र तरीका एक साफ स्मृति वाला साथी होना हो सकता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →