🤖 AI

IMAGAgent: Orchestrating Multi-Turn Image Editing via Constraint-Aware Planning and Reflection

यह शोध पत्र IMAGAgent को प्रस्तुत करता है, जो एक मल्टी-टर्न इमेज एडिटिंग फ्रेमवर्क है जो त्रुटि संचय (error accumulation) और सिमेंटिक ड्रिफ्ट (semantic drift) को दूर करने के लिए कंस्ट्रेंट-अवेयर प्लानिंग, टूल ऑर्केस्ट्रेशन और मल्टी-एक्सपर्ट रिफ्लेक्शन तंत्र का उपयोग करता है, जिससे MTEditBench और MagicBrush डेटासेट्स पर बेहतर प्रदर्शन प्राप्त होता है।

Fei Shen, Chengyu Xie, Lihong Wang, Zhanyi Zhang, Xin Jiang, Xiaoyu Du, Jinhui Tang2026-04-01
🤖 AI

An Empirical Study of Multi-Agent Collaboration for Automated Research

यह शोध पत्र ऑटोमेटेड मशीन लर्निंग ऑप्टिमाइज़ेशन के लिए सिंगल-एजेंट, सब-एजेंट और एजेंट टीम आर्किटेक्चर की तुलना करते हुए एक व्यवस्थित अनुभवजन्य अध्ययन प्रस्तुत करता है, जो एक मौलिक ट्रेड-ऑफ को प्रकट करता है जहाँ सब-एजेंट संरचनाएँ उथले कार्यों (shallow tasks) के लिए उच्च लचीलापन और थ्रूपुट प्रदान करती हैं, जबकि एजेंट टीमें परिचालन स्थिरता की कीमत पर जटिल रिफैक्टरिंग के लिए गहरा सैद्धांतिक संरेखण सक्षम करती हैं।

Yang Shen, Zhenyi Yi, Ziyi Zhao, Lijun Sun, Dongyang Li, Chin-Teng Lin, Yuhui Shi2026-04-01
🤖 AI

BotVerse: Real-Time Event-Driven Simulation of Social Agents

बॉटवर्स (BotVerse) एक स्केलेबल, इवेंट-ड्रिवन फ्रेमवर्क है जो वास्तविक समय के ब्लूस्काई (Bluesky) कंटेंट पर आधारित एक नियंत्रित वातावरण के भीतर इंटरैक्शन को अलग करके, एलएलएम (LLM)-आधारित एजेंटों के सुरक्षित, हाई-फिडेलिटी सोशल सिमुलेशन को सक्षम बनाता है, जिससे शोधकर्ता नैतिक जोखिमों के बिना जटिल सामाजिक गतिशीलता और रेड-टीम डिसइन्फॉर्मेशन परिदृश्यों का अध्ययन कर सकते हैं।

Edoardo Allegrini, Edoardo Di Paolo, Angelo Spognardi, Marinella Petrocchi2026-04-01
💬 NLP

SkillFlow: Scalable and Efficient Agent Skill Retrieval System

SkillFlow एक स्केलेबल, चार-चरणीय रिट्रीवल पाइपलाइन पेश करता है जो एक बड़े कम्युनिटी रिपॉजिटरी से प्रासंगिक स्किल्स को प्रभावी ढंग से चुनकर कोडिंग बेंचमार्क पर AI एजेंट के प्रदर्शन में महत्वपूर्ण सुधार करता है, जबकि यह भी रेखांकित करता है कि सिस्टम की अंतिम सफलता काफी हद तक उपलब्ध स्किल कॉर्पस की गुणवत्ता और निष्पादन क्षमता पर निर्भर करती है।

Fangzhou Li, Pagkratios Tagkopoulos, Ilias Tagkopoulos2026-03-31
🤖 AI

What Is Your Agent's GPA? A Framework for Evaluating Agent Goal-Plan-Action Alignment

यह शोध पत्र एजेंट GPA फ्रेमवर्क पेश करता है, जो एक स्केलेबल और सामान्यीकरण योग्य मूल्यांकन प्रणाली है जो गोल-प्लान-एक्शन (लक्ष्य-योजना-क्रिया) संरेखण को मापने के लिए डोमेन-विशिष्ट LLM जज उत्पन्न करने हेतु स्वचालित प्रॉम्प्ट अनुकूलन का उपयोग करती है, जिससे विभिन्न बेंचमार्क में उच्च सटीकता और मानव मूल्यांकनकर्ताओं के साथ उच्च सहमति के साथ एजेंट विफलताओं को प्रभावी ढंग से पहचानने और उन्हें स्थानीयकृत करने में सक्षम बनाया जा सके।

Allison Sihan Jia, Daniel Huang, Nikhil Vytla, Seung Won Wilson Yoo, Nirvika Choudhury, Shayak Sen, John C. Mitchell, An (…)2026-03-31
💬 NLP

AISAC: An Integrated multi-agent System for Transparent, Retrieval-Grounded Scientific Assistance

आर्गोन नेशनल लेबोरेटरी द्वारा विकसित, AISAC एक पारदर्शी, मॉड्यूलर मल्टी-एजेंट रनटाइम है जो भूमिका अर्थशास्त्र (role semantics), बजटयुक्त ऑर्केस्ट्रेशन, संरेखित मेमोरी एक्सेस और ट्रेस-संचालित पारदर्शिता के लिए संरचनात्मक गारंटियों को लागू करता है ताकि दहन और सामग्री अनुसंधान जैसे विविध डोमेन में साक्ष्य-आधारित वैज्ञानिक तर्क का समर्थन किया जा सके।

Chandrachur Bhattacharya, Sibendu Som2026-03-31
💻 computer science

Toward Evaluation Frameworks for Multi-Agent Scientific AI Systems

यह शोध पत्र मल्टी-एजेंट वैज्ञानिक AI प्रणालियों के बेंचमार्किंग की अनूठी चुनौतियों—जैसे कि तर्क (reasoning) को सूचना प्राप्ति (retrieval) से अलग करना और डेटा अखंडता सुनिश्चित करना—का विश्लेषण करता है और क्वांटम विज्ञान में नवीन अनुसंधान डेटासेट और विशेषज्ञ साक्षात्कार के माध्यम से प्रमाणित, संदूषण-प्रतिरोधी कार्यों (contamination-resistant tasks) और मल्टी-टर्न इंटरैक्शन सहित मूल्यांकन रणनीतियों का प्रस्ताव करता है।

Marcin Abram2026-03-31
💻 computer science

Breaking Exponential Complexity in Games of Ordered Preference: A Tractable Reformulation

यह शोध पत्र 'गेम्स ऑफ ऑर्डर्ड प्रेफरेंस' (GOOPs) के एक सुलभ, बहुपद-स्केलिंग (polynomially-scaling) पुनर्गठन को प्रस्तुत करता है जो घातीय रूप से जटिल KKT प्रणालियों को एक संक्षिप्त प्रणाली से प्रतिस्थापित करता है, जिससे एक प्रिमल-डुअल इंटीरियर-पॉइंट विधि के माध्यम से स्थानीय संतुलन की कुशल गणना सक्षम होती है और समाधान की वैधता को प्रमाणित करने के लिए स्थितियाँ प्रदान की जाती हैं।

Dong Ho Lee, Jingqi Li, Lasse Peters, Georgios Bakirtzis, David Fridovich-Keil2026-03-31
🤖 AI

MediHive: A Decentralized Agent Collective for Medical Reasoning

MediHive एक नवीन विकेंद्रीकृत मल्टी-एजेंट फ्रेमवर्क है जो स्वायत्त भूमिका निर्धारण, साक्ष्य-आधारित बहसों और पुनरावृत्ति सर्वसम्मति का लाभ उठाता है ताकि जटिल चिकित्सा तर्क कार्यों में सिंगल-LLM और केंद्रीकृत प्रणालियों से बेहतर प्रदर्शन किया जा सके।

Xiaoyang Wang, Christopher C. Yang2026-03-31
⚡ electrical engineering

GUIDE: Guided Updates for In-context Decision Evolution in LLM-Driven Spacecraft Operations

यह शोधपत्र GUIDE प्रस्तुत करता है, जो एक नॉन-पैरामीट्रिक फ्रेमवर्क है जो ऑफलाइन रिफ्लेक्शन के माध्यम से प्राकृतिक भाषा के निर्णय नियमों की एक संरचित प्लेबुक को विकसित करके LLM-संचालित अंतरिक्ष यान संचालन को बढ़ाता है, जिससे मॉडल वेट अपडेट के बिना निरंतर नीति सुधार सक्षम होता है।

Alejandro Carrasco, Mariko Storey-Matsutani, Victor Rodriguez-Fernandez, Richard Linares2026-03-31