Scaling Multi-agent Systems: A Smart Middleware for Improving Agent Interactions
यह शोध पत्र कॉग्निटिव फैब्रिक नोड्स (CFN) को प्रस्तुत करता है, जो एक नवीन मिडलवेयर लेयर है जो मल्टी-एजेंट सिस्टम में टोपोलॉजी, सुरक्षा और सिमेंटिक अलाइनमेंट को गतिशील रूप से अनुकूलित करने के लिए एक्टिव मेमोरी और रिइन्फोर्समेंट लर्निंग का लाभ उठाता है, जिससे डायरेक्ट एजेंट-टू-एजेंट कम्युनिकेशन की तुलना में प्रदर्शन में 10% से अधिक का सुधार होता है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि अत्यधिक बुद्धिमान लेकिन थोड़े बिखरे हुए विशेषज्ञों की एक टीम मिलकर एक विशाल पहेली को हल करने की कोशिश कर रही है। काम करने के वर्तमान तरीके (जिसे "डायरेक्ट एजेंट-टू-एजेंट कम्युनिकेशन" कहा जाता है) में, विशेषज्ञ A बस विशेषज्ञ B को एक सवाल चिल्लाकर बोल देता है। यदि विशेषज्ञ B सवाल को गलत समझ लेता है, संदर्भ भूल जाता है, या किसी चालाकी भरे सवाल से भ्रमित हो जाता है, तो पूरी टीम विफल हो जाती है। वे एक-दूसरे की बात अनसुनी करते हैं, गलतियों को दोहराते हैं, और कभी-कभी उन तथ्यों पर भी बहस करते हैं जो अस्तित्व में ही नहीं हैं।
यह शोध पत्र एक नया "बिचौलिया" प्रस्तावित करता है जिसे कॉग्निटिव फैब्रिक नोड (CFN) कहा जाता है। इसे एक साधारण डाकिया न समझें जो केवल पत्र पहुँचाता है, बल्कि इसे एक अति-बुद्धिमान, सर्वव्यापी अनुवादक और प्रोजेक्ट मैनेजर के रूप में देखें जो हर विशेषज्ञ के बीच बैठा है।
यह कैसे काम करता है, इसके सरल अवधारणाओं में विवरण यहाँ दिया गया है:
1. "कॉग्निटिव फैब्रिक" (स्मार्ट बिचौलिया)
विशेषज्ञों को सीधे बात करने देने के बजाय, उनका हर संदेश पहले इस बिचौलिए के पास जाता है।
- पुराना तरीका: आप अपने पड़ोसी को चिल्लाकर कहते हैं, "लीक ठीक करो!" आपके पड़ोसी को शायद पता नहीं होगा कि कौन सा पाइप लीक हो रहा है क्योंकि आपने उसे बताया नहीं।
- नया तरीका: आप बिचौलिए को बताते हैं, "लीक ठीक करो।" बिचौलिया ब्लूप्रिंट (मेमोरी) की जाँच करता है, यह समझता है कि आपका मतलब किचन सिंक से है, यह जाँचता है कि क्या आपके पास पाइपों को छूने की अनुमति है (सुरक्षा), और फिर आपके संदेश को आपके पड़ोसी के लिए इस तरह से फिर से लिखता है: "कृपया किचन सिंक के पाइप पर रिंच का उपयोग करें।"
2. बिचौलिए की पाँच महाशक्तियाँ
शोध पत्र कहता है कि इस बिचौलिए के पास पाँच विशिष्ट कार्य हैं, जो अनुभव से सीखने वाले एक "मस्तिष्क" द्वारा संचालित होते हैं:
एक्टिव मेमोरी (साझा मस्तिष्क):
आमतौर पर, कंप्यूटर डेटा को केवल एक फाइलिंग कैबिनेट की तरह स्टोर करते हैं। यह सिस्टम मेमोरी को एक जीवित मस्तिष्क की तरह मानता है। यह याद रखता है कि पाँच मिनट पहले क्या हुआ था और इसका उपयोग यह समझने के लिए करता है कि अभी क्या हो रहा है। यदि कोई विशेषज्ञ कहता है, "सर्वर डाउन है," लेकिन मेमोरी कहती है कि "सर्वर दो सेकंड पहले ठीक हो गया था," तो बिचौलिया उस विशेषज्ञ को गलत जानकारी फैलाने से रोकता है। यह सभी को एक ही पृष्ठ पर रखता है।टोपोलॉजी सिलेक्शन (स्मार्ट डिस्पैचर):
विशेषज्ञों को यह हार्ड-कोड करने के बजाय कि वे किससे बात करेंगे (जैसे, "मैं हमेशा बॉब से बात करता हूँ"), वे बस अपना इरादा (intent) चिल्ला देते हैं (जैसे, "मुझे किसी ऐसे व्यक्ति की आवश्यकता है जो गणित जानता हो")। बिचौलिया पूरे दल को देखता है, देखता है कि वर्तमान में कौन खाली है और गणित में कुशल है, और कार्य को वहीं भेज देता है। यह एक राइड-शेयर ऐप की तरह है जो आपकी विशिष्ट यात्रा के लिए सबसे अच्छे ड्राइवर को चुनता है, बजाय इसके कि आपको हर ड्राइवर का नाम पता हो।सिमेंटिक ग्राउंडिंग (शब्दकोश और सत्य-जांचकर्ता):
अलग-अलग विशेषज्ञ एक ही चीज़ के लिए अलग-अलग शब्दों का उपयोग कर सकते हैं। एक "क्लाइंट आईडी" कह सकता है, जबकि दूसरा "कस्टमर UUID" समझ सकता है। बिचौलिया इन शब्दों का अनुवाद करता है ताकि वे मेल खा सकें। यह एक सत्य डिटेक्टर के रूप में भी कार्य करता है। यदि कोई विशेषज्ञ ऐसी फ़ाइल के बारे में बात करने की कोशिश करता है जो मौजूद नहीं है ("घोस्ट एंटिटी"), तो बिचौलिया किसी काल्पनिक फ़ाइल को खोजने में समय बर्बाद करने से पहले ही बातचीत को रोक देता है।सिक्योरिटी पॉलिसी एनफोर्समेंट (बाउंसर):
सुरक्षा केवल बुरे शब्दों को रोकने के बारे में नहीं है; यह इरादे को समझने के बारे में है। बिचौलिया सख्त नियमों (जैसे "सोशल सिक्योरिटी नंबर कभी साझा न करें") और एक सीखे हुए "अंतर्ज्ञान" (जैसे "यह अनुरोध संदिग्ध लग रहा है") के मिश्रण का उपयोग करता है। यह उन जटिल हमलों को भी पकड़ सकता है जहाँ एक बुरा तत्व एक खतरनाक अनुरोध को तीन हानिरहित दिखने वाले संदेशों में विभाजित करता है। बिचौलिया पूरे पैटर्न को देखता है और हमले को रोकता है।ट्रांसफॉर्मेशन और री-राइटिंग (संपादक):
यह सबसे सक्रिय हिस्सा है। बिचौलिया एक अस्पष्ट, अव्यवस्थित या खतरनाक संदेश को लेता है और उसे अगले विशेषज्ञ तक पहुँचने से पहले एक सटीक, स्पष्ट और सुरक्षित निर्देश में फिर से लिख देता है। यह एक संपादक की तरह है जो एक कच्चे ड्राफ्ट को प्रकाशित होने से पहले एक पॉलिश किए गए लेख में बदल देता है।
3. यह कैसे सीखता है (द "कोच")
बिचौलिया स्थिर नहीं है; यह समय के साथ स्मार्ट होता जाता है। यह रीइन्फोर्समेंट लर्निंग (Reinforcement Learning) नामक एक विधि का उपयोग करता है।
- कल्पना कीजिए कि एक कोच खेल देख रहा है। यदि गेंद पास करने का एक विशिष्ट तरीका लक्ष्य तक ले जाता है, तो कोच उसे नोट करता है। यदि बातचीत का एक निश्चित तरीका गलतफहमी का कारण बनता है, तो कोच उसे भी नोट करता है।
- इस सिस्टम में, यदि बिचौलिया एक प्रॉम्प्ट को फिर से लिखता है और कार्य तेजी से हल हो जाता है, तो वह इसे फिर से करने के लिए सीखता है। यदि रीराइट करने से भ्रम पैदा होता है, तो वह कुछ और करने के लिए सीखता है।
4. परिणाम: क्या यह काम करता है?
शोधकर्ताओं ने इस प्रणाली का परीक्षण दो कठिन प्रश्न-उत्तर चुनौतियों (HotPotQA और MuSiQue) पर किया।
- सेटअप: उन्होंने AI एजेंटों की एक टीम को एक कार्य दिया जिसमें जानकारी विभाजित थी, जिससे उन्हें सहयोग करने के लिए मजबूर होना पड़ा।
- समस्या: बिचौलिए के बिना, टीम का प्रदर्शन काफी गिर गया क्योंकि वे भ्रमित हो गए और संदर्भ खो बैठे।
- समाधान: जब उन्होंने कॉग्निटिव फैब्रिक नोड जोड़ा, तो टीम का प्रदर्शन वापस ऊपर आ गया।
- स्कोर: बिचौलिए वाले सिस्टम ने सीधे एक-दूसरे से बात करने वाली टीम की तुलना में प्रदर्शन में 10% से अधिक सुधार किया। यह लगभग एक अकेले, पूर्ण AI के प्रदर्शन स्तर तक पहुँच गया, जो यह सिद्ध करता है कि "बिचौलिए" ने संचार की अराजकता को सफलतापूर्वक ठीक कर दिया।
सारांश
शोध पत्र का तर्क है कि हमें केवल व्यक्तिगत AI एजेंटों को स्मार्ट बनाने पर ध्यान नहीं देना चाहिए; हमें उस नेटवर्क को स्मार्ट बनाना चाहिए जिसमें वे रहते हैं। एजेंटों के बीच इस "कॉग्निटिव फैब्रिक" को डालकर, हम बिखरे हुए विचारकों के एक अराजक समूह को एक सुसंगत, सुरक्षित और कुशल टीम में बदल देते हैं जो सत्य के एक एकल स्रोत को साझा करते हैं।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।