🤖 AI

Weak-Link Optimization for Multi-Agent Reasoning and Collaboration

यह शोध पत्र WORC का प्रस्ताव करता है, जो एक दो-चरणीय ढांचा है जो एक मेटा-लर्निंग-आधारित प्रेडिक्टर का उपयोग करके कमजोर एजेंटों की पहचान करने और उन्हें अतिरिक्त रीजनिंग बजट आवंटित करने के लिए अनिश्चितता-संचालित रणनीति का उपयोग करके मल्टी-एजेंट रीजनिंग स्थिरता को बढ़ाता है, जिससे समग्र सिस्टम सटीकता और मजबूती में सुधार होता है।

Haoyu Bian, Chaoning Zhang, Jiaquan Zhang, Xingyao Li, Yuanfang Guo, Wei Dong, Yang Yang2026-04-20
🤖 AI

SocialGrid: A Benchmark for Planning and Social Reasoning in Embodied Multi-Agent Systems

यह शोध पत्र सोशलग्रिड (SocialGrid) को प्रस्तुत करता है, जो 'अमंग अस' (Among Us) से प्रेरित एक एम्बोडीड मल्टी-एजेंट बेंचमार्क है, जो यह प्रकट करता है कि वर्तमान बड़े भाषा मॉडल योजना (planning) और सामाजिक तर्क (social reasoning) दोनों कार्यों में, विशेष रूप से धोखे का पता लगाने में, काफी संघर्ष करते हैं, जबकि यह इन विशिष्ट विफलताओं को अलग करने और निदान करने के लिए प्लानिंग ओरैकल (Planning Oracle) और स्वचालित मेट्रिक्स जैसे उपकरण भी प्रदान करता है।

Hikaru Shindo, Hanzhao Lin, Lukas Helff, Patrick Schramowski, Kristian Kersting2026-04-20
💻 computer science

AstroVLM: Expert Multi-agent Collaborative Reasoning for Astronomical Imaging Quality Diagnosis

AstroVLM एक सहयोगात्मक मल्टी-एजेंट सिस्टम है जिसे विशेषज्ञ तर्क का लाभ उठाकर जटिल खगोलीय छवियों की गुणवत्ता का निदान करने के लिए डिज़ाइन किया गया है, जो वास्तविक दुनिया के कार्यों में मौजूदा बेसलाइन से बेहतर प्रदर्शन करता है।

Yaohui Han, Tianshuo Wang, Zixi Zhao, Zhengchun Zhu, Shuo Ren, Yiru Wang, Rongliang Fu, Tinghuan Chen, Tsung-Yi Ho2026-04-20
💻 computer science

Veritas-RPM: Provenance-Guided Multi-Agent False Positive Suppression for Remote Patient Monitoring

यह शोध पत्र Veritas-RPM प्रस्तुत करता है, जो एक पांच-परतीय मल्टी-एजेंट आर्किटेक्चर है जिसे प्रोवेनेंस-गाइडेड दृष्टिकोण और 98 फॉल्स-पॉजिटिव परिदृश्यों के एक सिंथेटिक टैक्सोनॉमी का उपयोग करके रिमोट पेशेंट मॉनिटरिंग में फॉल्स पॉजिटिव्स को दबाने के लिए डिज़ाइन किया गया है, ताकि फॉल्स एस्केलेशन को कम करते हुए उच्च ट्रू सप्रेशन दर प्राप्त की जा सके।

Aswini Misro, Vikash Sharma, Shreyank N Gowda2026-04-20
💰 quantitative finance

Implications of zero-growth economics analysed with an agent-based model

PG-DYNAMIN एजेंट-आधारित मॉडल का उपयोग करते हुए, यह अध्ययन प्रदर्शित करता है कि जबकि शून्य-विकास अर्थव्यवस्थाएं विकास परिदृश्यों की तुलना में अधिक व्यापक आर्थिक स्थिरता, कम बेरोजगारी और कम कॉर्पोरेट ऋण प्रदान करती हैं, वे उच्च मुद्रास्फीति, बढ़ी हुई बाजार एकाग्रता और उच्च फर्म डिफॉल्ट संभावनाओं के साथ अधिक गंभीर संकट भी लाती हैं।

Dylan C. Terry-Doyle, Adam B. Barrett2026-04-17
💬 NLP

Theory of Mind in Action: The Instruction Inference Task in Dynamic Human-Agent Collaboration

यह शोध पत्र 'इंस्ट्रक्शन इन्फरेंस टास्क' और 'टॉमकेट' (Tomcat) का परिचय देता है, जो एक LLM-आधारित एजेंट है जिसे अस्पष्ट निर्देशों से अनकही मंशाओं का अनुमान लगाकर 'थ्योरी ऑफ माइंड' का अभ्यास करने के लिए डिज़ाइन किया गया है, जो यह प्रदर्शित करता है कि 'फ्यू-शॉट चेन-ऑफ-थॉट रीजनिंग' का उपयोग करने वाले वेरिएंट गतिशील मानव-एजेंट सहयोग में मानव-तुलनीय प्रदर्शन प्राप्त करते हैं।

Fardin Saad, Pradeep K. Murukannaiah, Munindar P. Singh2026-04-17
💬 NLP

Don't Retrieve, Navigate: Distilling Enterprise Knowledge into Navigable Agent Skills for QA and RAG

यह शोध पत्र Corpus2Skill प्रस्तुत करता है, जो एक ऐसी विधि है जो दस्तावेज़ कॉर्पोरा को पदानुक्रमित (hierarchical), सु navigatable कौशल वृक्षों (skill trees) में परिवर्तित करती है ताकि LLM एजेंटों को एंटरप्राइज ज्ञान संरचनाओं के बारे में सक्रिय रूप से अन्वेषण करने और तर्क करने में सक्षम बनाया जा सके, जिससे वे QA बेंचमार्क पर पारंपरिक पुनर्प्राप्ति-आधारित (retrieval-based) दृष्टिकोणों से बेहतर प्रदर्शन करते हैं।

Yiqun Sun, Pengfei Wei, Lawrence B. Hsieh2026-04-17
💻 computer science

FedGUI: Benchmarking Federated GUI Agents across Heterogeneous Platforms, Devices, and Operating Systems

यह शोध पत्र FedGUI प्रस्तुत करता है, जो विषम मोबाइल, वेब और डेस्कटॉप प्लेटफॉर्म्स पर फेडरेटेड GUI एजेंटों का मूल्यांकन करने के लिए डिज़ाइन किया गया पहला व्यापक बेंचमार्क है, जो क्यूरेटेड डेटासेट और इस बात में प्रमुख अंतर्दृष्टि प्रदान करता है कि क्रॉस-प्लेटफॉर्म सहयोग और विशिष्ट विषमता कारक एजेंट के प्रदर्शन को कैसे प्रभावित करते हैं।

Wenhao Wang, Haoting Shi, Mengying Yuan, Yiquan Lin, Panrong Tong, Hanzhang Zhou, Guangyi Liu, Pengxiang Zhao, Yue Wang (…)2026-04-17
💬 NLP

RadAgents: Multimodal Agentic Reasoning for Chest X-ray Interpretation with Radiologist-like Workflows

RadAgents एक नवीन मल्टी-एजेंट फ्रेमवर्क है जो रेडियोलॉजिस्ट के वर्कफ़्लो का अनुकरण करने के लिए क्लिनिकल प्रायर्स (clinical priors), टास्क-अवेयर मल्टीमॉडल रीजनिंग और ग्राउंडिंग मैकेनिज्म को एकीकृत करके चेस्ट एक्स-रे व्याख्या को बढ़ाता है, जिससे नैदानिक रूप से संरेखित, विजुअली ग्राउंडेड और सत्यापन योग्य डायग्नोस्टिक आउटपुट प्राप्त होता है।

Kai Zhang, Corey D Barrett, Jangwon Kim, Lichao Sun, Tara Taghavi, Krishnaram Kenthapadi2026-04-16
💻 computer science

Form Without Function: Agent Social Behavior in the Moltbook Network

यह शोध पत्र मोल्टबुक (Moltbook) नेटवर्क का विश्लेषण करता है, जो पूरी तरह से एआई एजेंटों से बना एक सामाजिक मंच है, यह प्रदर्शित करने के लिए कि जबकि इसका तकनीकी बुनियादी ढांचा कार्य करता है और निर्देशों का जवाब देता है, इसका सामाजिक स्तर उभरने में विफल रहता है, जिसके परिणामस्वरूप एक ऐसी प्रणाली बनती है जो सोशल मीडिया के रूप की नकल तो करती है लेकिन उसके आवश्यक मानव-समान कार्य को नहीं।

Saber Zerhoudi, Kanishka Ghosh Dastidar, Felix Klement, Artur Romazanov, Andreas Einwiller, Dang H. Dang, Michael Dinzin (…)2026-04-16