🤖 AI

Interpretable Failure Analysis in Multi-Agent Reinforcement Learning Systems

यह शोध पत्र एक दो-चरणीय, ग्रेडिएंट-आधारित ढांचे को प्रस्तुत करता है जो पॉलिसी ग्रेडिएंट्स और क्रिटिक डेरिवेटिव्स के ज्यामितीय विश्लेषण के माध्यम से प्रारंभिक विफलता स्रोतों का सटीक रूप से पता लगाकर और प्रसार मार्गों का पता लगाकर मल्टी-एजेंट सुदृढीकरण शिक्षण (मल्टी-एजेंट रीइन्फोर्समेंट लर्निंग) प्रणालियों में व्याख्या योग्य विफलता विश्लेषण को सक्षम बनाता है।

Risal Shahriar Shefin, Debashis Gupta, Thai Le, Sarra Alqahtani2026-02-24
💬 NLP

G2CP: A Graph-Grounded Communication Protocol for Verifiable and Efficient Multi-Agent Reasoning

G2CP एक ग्राफ-आधारित संचार प्रोटोकॉल पेश करता है जो मल्टी-एजेंट सिस्टम के लिए प्राकृतिक भाषा को संरचित ग्राफ ऑपरेशन्स से बदल देता है, जिससे टोकन के उपयोग और मतिभ्रम (hallucinations) में काफी कमी आती है और जटिल औद्योगिक कार्यों में तर्क की सटीकता और सत्यापन क्षमता में सुधार होता है।

Karim Ben Khaled, Davy Monticolo2026-02-24
💻 computer science

Exact Algorithms for Resource Reallocation Under Budgetary Constraints

यह शोध पत्र बजटीय बाधाओं के तहत क्लाइंट पुनर्वितरण (client reallocations) को न्यूनतम करने के लिए रेड-ब्लू रीइन्फोर्समेंट समस्या को प्रस्तुत करता है और तीन फिक्स्ड-पैरामीटर ट्रेक्टेबल सटीक एल्गोरिदम पेश करता है जो क्लस्टर दूरी (distance to cluster), मॉड्यूलैरिटी-विड्थ (modular-width), या क्लिक-विड्थ (clique-width) से सीमित ग्राफ पर इस समस्या को कुशलतापूर्वक हल करते हैं।

Arun Kumar Das, Sandip Das, Sweta Das, Foivos Fioravantes, Nikolaos Melissinos2026-02-24
💻 computer science

Evolution of fairness in hybrid populations with specialised AI agents

यह शोध पत्र प्रदर्शित करता है कि हाइब्रिड मानव-एआई समाजों में, चयनात्मक, अपेक्षा-आधारित प्रस्तावों के माध्यम से निष्पक्षता लागू करने वाले रणनीतिक एआई एजेंट, बिना शर्त "समरिटन" (Samaritan) एआई एजेंटों की तुलना में न्यायसंगत परिणामों को बनाए रखने और आवश्यक एजेंटों के महत्वपूर्ण द्रव्यमान (critical mass) को कम करने में काफी अधिक प्रभावी हैं।

Zhao Song, Theodor Cimpeanu, Chen Shen, The Anh Han2026-02-24
🤖 AI

EDU-MATRIX: A Society-Centric Generative Cognitive Digital Twin Architecture for Secondary Education

EDU-MATRIX माध्यमिक शिक्षा के लिए एक समाज-केंद्रित जनरेटिव संज्ञानात्मक डिजिटल ट्विन आर्किटेक्चर है जो कठोर एजेंट-केंद्रित नियमों को एक गतिशील "सामाजिक स्थान" मॉडल से प्रतिस्थापित करता है, जो उभरते हुए, मूल्य-संरेखित सामाजिक व्यवहारों को उत्पन्न करने के लिए एनवायरनमेंट कॉन्टेक्स्ट इंजेक्शन इंजन, एक मॉड्यूलर लॉजिक इवोल्यूशन प्रोटोकॉल और रोल-टोपोलॉजी के माध्यम से एंडोजेनस अलाइनमेंट का उपयोग करता है।

Wenjing Zhai, Jianbin Zhang, Tao Liu2026-02-24
🤖 AI

Safe and Interpretable Multimodal Path Planning for Multi-Agent Cooperation

यह शोध पत्र CaPE को प्रस्तुत करता है, जो एक सुरक्षित और व्याख्या योग्य मल्टीमॉडल पाथ प्लानिंग फ्रेमवर्क है जो विजन-लैंग्वेज मॉडल्स का लाभ उठाकर सत्यापित पाथ-एडिटिंग प्रोग्राम्स को संश्लेषित करता है, जिससे विकेंद्रीकृत एजेंटों को अन्य एजेंटों से प्राप्त भाषाई संचार के आधार पर टकराव से बचने और भौतिक सहयोग के लिए अपने प्रक्षेप पथों (ट्रैजेक्टरीज) को प्रभावी ढंग से अनुकूलित करने में सक्षम बनाया जा सके।

Haojun Shi, Suyu Ye, Katherine M. Guerrerio, Jianzhi Shen, Yifan Yin, Daniel Khashabi, Chien-Ming Huang, Tianmin Shu2026-02-24
💻 computer science

Effects of Property Recovery Incentives and Social Interaction on Self-Evacuation Decisions in Natural Disasters: An Agent-Based Modelling Approach

यह अध्ययन विकासवादी गेम थ्योरी (evolutionary game theory) पर आधारित एक एजेंट-आधारित मॉडल का उपयोग करता है ताकि यह प्रदर्शित किया जा सके कि प्राकृतिक आपदा निकासी नीतियों को अनुकूलित करने के लिए संपत्ति पुनर्प्राप्ति प्रोत्साहन और सामाजिक नेटवर्क संरचनाओं के बीच संतुलन बनाना आवश्यक है, जो यह प्रकट करता है कि अच्छी तरह से जुड़े "सामुदायिक प्रभावकों" (community influencers) को प्राथमिकता देना अंधाधुंध या कम-संपर्क वाले समर्थन की तुलना में बेहतर सामूहिक परिणाम प्रदान करता है।

Made Krisnanda, Raymond Chiong, Yang Yang, Kirill Glavatskiy2026-02-24
🤖 machine learning

Nested Training for Mutual Adaptation in Human-AI Teaming

यह शोध पत्र एक इंटरैक्टिव पार्शियली ऑब्जर्वेबल मार्कोव डिसीजन प्रोसेस (I-POMDP) ढांचे के भीतर एक नेस्टेड प्रशिक्षण शासन का प्रस्ताव करता है ताकि उन एआई एजेंटों को प्रशिक्षित किया जा सके जो अपारदर्शी, सह-प्रशिक्षित-विशिष्ट समन्वय रणनीतियों को विकसित किए बिना उन्हें अनुकूलन योग्य व्यवहारों के संपर्क में लाकर मानव भागीदारों के प्रति प्रभावी ढंग से अनुकूलित हो सकें, जिससे ओवरकुक्ड (Overcooked) जैसे सहकारी परिवेशों में अनदेखे अनुकूलन योग्य भागीदारों के साथ बेहतर सामान्यीकरण और कार्य प्रदर्शन प्राप्त किया जा सके।

Upasana Biswas, Durgesh Kalwar, Subbarao Kambhampati, Sarath Sreedharan2026-02-23
🔢 mathematics

Reasoning-Native Agentic Communication for 6G

यह शोध पत्र "रीज़निंग-नेटिव एजेंटिक कम्युनिकेशन" को एक नए 6G प्रतिमान (पैराडाइम) के रूप में प्रस्तावित करता है जो पारंपरिक चैनल या डेटा मेट्रिक्स के बजाय अनुमानित विश्वास विचलन (बलीफ डाइवर्जेंस) के आधार पर ट्रांसमिशन को ट्रिगर करके स्वायत्त एजेंटों के बीच समन्वय विचलन (कोऑर्डिनेशन ड्रिफ्ट) को सक्रिय रूप से रोकता है, जिससे नेटवर्क वितरित तर्क (डिस्ट्रीब्यूटेड रीज़निंग) के सक्रिय सामंजस्यकर्ता में परिवर्तित हो जाते हैं।

Hyowoon Seo, Joonho Seon, Jin Young Kim, Mehdi Bennis, Wan Choi, Dong In Kim2026-02-23
🤖 AI

MultiVer: Zero-Shot Multi-Agent Vulnerability Detection

MultiVer एक ज़ीरो-शॉट मल्टी-एजेंट एन्सेम्बल सिस्टम है जो बिना फाइन-ट्यूनिंग के वल्नरेबिलिटी डिटेक्शन में स्टेट-ऑफ-द-आर्ट रिकॉल प्राप्त करता है, जो प्रिसिजन के बजाय फॉल्स नेगेटिव्स को कम करने को प्राथमिकता देकर PyVul बेंचमार्क पर स्पेशलाइज्ड फाइन-ट्यून्ड मॉडल्स से भी बेहतर प्रदर्शन करता है।

Shreshth Rajan2026-02-23