🤖 AI

Distributed Agent System: Fault-Tolerant Collaboration Among Embodied Agents

यह शोध पत्र डिस्ट्रिब्यूटेड एजेंट सिस्टम (DAS) को प्रस्तुत करता है, जो एक डिवाइस-एज-क्लाउड फ्रेमवर्क है जो विश्वसनीयता को सिस्टम-स्तरीय दोष सहिष्णुता (फॉल्ट टॉलरेंस) के रूप में पुनर्परिभाषित करके और संचयी त्रुटि प्रसार को कम करने के लिए सेमी-फॉर्मल संचार प्रोटोकॉल के साथ फॉल्ट-टॉलरेंट अलाइनमेंट को संयोजित करने वाले दो-स्तरीय आर्किटेक्चर को लागू करके औद्योगिक परिदृश्यों में विषम एम्बॉडीड एजेंटों के बीच विश्वसनीय सहयोग सुनिश्चित करता है।

Kai Yu, Lu Chen, Hanqi Li2026-07-14
🤖 AI

Auditing Belief-Conditioned LLM Agents in Hidden-Information Social Deduction Games

यह शोध पत्र छिपी हुई जानकारी वाले सोशल डिटेक्शन गेम्स में एलएलएम (LLM) एजेंटों के मूल्यांकन के लिए एक ऑडिट करने योग्य ढांचे को प्रस्तुत करता है, जो यह प्रदर्शित करता है कि हालांकि सक्रिय विश्वास रखरखाव (active belief maintenance) वेयरवोल्फ (Werewolf) में अच्छी टीम की जीत की दर में महत्वपूर्ण सुधार करता है, लेकिन अंतर्निहित तंत्र अनसुलझा बना हुआ है क्योंकि इसमें प्रत्यक्ष क्रिया-विश्वास निरंतरता कम है और जब विश्वास केवल वेयरवोल्फ तक सीमित होते हैं तो अप्रत्याशित लाभ मिलते हैं।

Yuan Gao, Jiangyi Yang, Yao Zhao, Yichi Zhang2026-07-14
🤖 AI

Multi-Agent LLMs Fail to Explore Each Other

यह शोध पत्र एक मौलिक सीमा की पहचान करता है जहाँ आधुनिक LLM एजेंट मल्टी-एजेंट परिवेश में एक-दूसरे को प्रभावी ढंग से एक्सप्लोर करने में विफल रहते हैं, जिससे उप-इष्टतम समन्वय होता है, और संरचित पीयर चयन (peer selection) को स्पष्ट रूप से बढ़ावा देने के लिए मल्टी-एजेंट कॉन्टेक्स्टुअल एक्सप्लोरेशन (MACE) फ्रेमवर्क का प्रस्ताव करता है, जिससे एक्सप्लोरेशन व्यवहार और कार्य प्रदर्शन में महत्वपूर्ण सुधार होता है।

Hyeong Kyu Choi, Jiatong Li, Wendi Li, Xin Eric Wang, Sharon Li2026-07-14
💬 NLP

StructAgent: Harness Long-horizon Digital Agents with Unified Causal Structure

StructAgent एक अवस्था-केंद्रित (state-centered) ढांचे को पेश करता है जो लंबी अवधि के डिजिटल एजेंट कार्यों को प्रबंधित करने के लिए एकीकृत कारण संरचनाओं (unified causal structures) का उपयोग करता है, जो सत्यापन योग्य, साक्ष्य-आधारित प्रगति ट्रैकिंग और रिकवरी को सक्षम करके विविध LLM/VLM बैकबोन और परिवेशों में सफलता दर और सामान्यीकरण क्षमता में महत्वपूर्ण सुधार करता है।

Wenyi Wu, Sibo Zhu, Kun Zhou, Aayush Salvi, Zixuan Song, Biwei Huang2026-07-14
💻 computer science

Multi-Agent Reinforcement Learning for C-V2X RAT Selection

यह शोध पत्र Uu, PC5 और हाइब्रिड चैनलों के बीच अनुकूली C-V2X रेडियो एक्सेस टेक्नोलॉजी चयन के लिए एक मल्टी-एजेंट प्रॉक्सिमल पॉलिसी ऑप्टिमाइज़ेशन (MAPPO) एल्गोरिदम प्रस्तावित करता है, जो विषम अनुप्रयोग आवश्यकताओं वाले शहरी परिदृश्यों में सिंगल-एजेंट DRL और स्टैटिक बेसलाइन्स की तुलना में बेहतर ऑन-टाइम डिलीवरी अनुपात और कम प्रशिक्षण समय प्रदर्शित करता है।

Moritz Schaffenroth, Uwe Kölbel, Heike Lepke, Alexander Prinz, Alfred Höß2026-07-14
🤖 machine learning

When Local Monitors Miss Compositional Harm: Diagnosing Distributed Backdoors in Multi-Agent Systems

यह शोध पत्र प्रदर्शित करता है कि मल्टी-एजेंट LLM सिस्टम में स्थानीय रनटाइम मॉनिटर उन वितरित बैकडोर्स (distributed backdoors) का पता लगाने में विफल रहते हैं जब हानिकारक पेलोड को व्यक्तिगत रूप से निर्दोष अंशों में विभाजित किया जाता है, जो एक अवलोकन सीमा (observability boundary) स्थापित करता है जहाँ सुरक्षा केवल तभी सुनिश्चित की जा सकती है जब असेंबल की गई वस्तु का पता लगाया जाए या उस अंतर्निहित प्रतिनिधित्व तक पहुँचा जाए जहाँ क्षति उजागर होती है।

Yibo Hu, Ren Wang2026-07-14
💬 NLP

Forgetting Our Way to Shared Meaning: Effects of Forgetting on Conceptual Alignment in a Non-Partnership Coordination Game

यह शोध पत्र इस बात की जांच करता है कि स्मृति की विशेषताएँ, जैसे कि अनुकूलनशीलता और क्षरण, एक गैर-साझेदारी समन्वय खेल (non-partnership coordination game) में साझा अर्थ के उद्भव और विकास को कैसे प्रभावित करती हैं, यह प्रकट करते हुए कि अनुकूलनशील एजेंट तेज़ और अधिक सटीक वैचारिक अभिसरण प्राप्त करते हैं जबकि गैर-अनुकूलनशील एजेंट अभिसरण को पहले अनुभव करते हैं, और समय के साथ नवीन सूचना को धीरे-धीरे कम महत्व देना अधिक स्थिर समझौतों को बढ़ावा देता है।

Landon Liu, Mary Kelly, Alan Tsang2026-07-14
💻 computer science

JustAct: A Framework for Auditable Multi-Agent Systems Regulated by Inter-Organisational Policies

यह शोध पत्र JustAct को प्रस्तुत करता है, जो अंतर-संगठनात्मक नीतियों द्वारा विनियमित ऑडिट करने योग्य मल्टी-एजेंट सिस्टम के लिए एक ढांचा है, जो डायनेमिक पॉलिसी जस्टिफिकेशन के माध्यम से गैर-खंडनीय अनुमति निर्णयों की गारंटी देता है, जिसे एक रस्ट (Rust) कार्यान्वयन और एक मेडिकल डेटा प्रोसेसिंग केस स्टडी के माध्यम से मान्य किया गया है।

Christopher A. Esterhuyse, Tim Müller, L. Thomas van Binsbergen2026-07-13
💬 NLP

Leveraging Multi-Agent System (MAS) and Fine-Tuned Small Language Models (SLMs) for Automated Telecom Network Troubleshooting

यह शोध पत्र एक मल्टी-एजेंट सिस्टम का प्रस्ताव करता है जो रेडियो एक्सेस और कोर नेटवर्क डोमेन में रूट-कॉज़ डायग्नोसिस (मूल कारण निदान) को त्वरित करने और मैनुअल विशेषज्ञ हस्तक्षेप पर निर्भरता को महत्वपूर्ण रूप से कम करने के लिए विशेष उपकरणों और एक फाइन-ट्यून किए गए स्मॉल लैंग्वेज मॉडल को समन्वित करता है ताकि टेलीकॉम नेटवर्क ट्रबलशूटिंग को स्वचालित किया जा सके।

Chenhua Shi, Bhavika Jalli, Gregor Macdonald, John Zou, Wanlu Lei, Mridul Jain, Joji Philip2026-07-13
💻 computer science

Offline Nash Solvers Meet Online Tree Search in Multi-Agent Games on Graphs

यह शोध पत्र प्रिमिटिव-गाइडेड ट्री सर्च (PGTS) प्रस्तुत करता है, जो एक हाइब्रिड फ्रेमवर्क है जो ग्राफ पर मल्टी-एजेंट पर्स्यूट-इवेजन (पीछा करने और बचने वाले) खेलों को प्रभावी ढंग से हल करने के लिए सुलभ उप-खेलों (सब-गेम्स) पर ऑफलाइन सटीक नैश इक्विलिब्रियम गणनाओं को ऑनलाइन ट्री सर्च के साथ जोड़ता है, जो मौजूदा लर्निंग और ह्यूरिस्टिक बेसलाइन्स से काफी बेहतर प्रदर्शन करता है।

Mukesh Kumar, Yue Guan, Panagiotis Tsiotras2026-07-13