🤖 AI

Unifying Temporal and Structural Credit Assignment in LLM-Based Multi-Agent Prompt Optimization

यह शोध पत्र लार्ज लैंग्वेज मॉडल-आधारित मल्टी-एजेंट सिस्टम को अनुकूलित करने के लिए एक नवीन ढांचे का प्रस्ताव करता है जो लक्षित, कुशल प्रॉम्प्ट रिफाइनमेंट के लिए एक डिस्क्रीट, वर्बलाइज्ड ब्लॉक कोऑर्डिनेट डिसेंट एल्गोरिदम को निर्देशित करने हेतु टेम्पोरल और स्ट्रक्चरल क्रेडिट असाइनमेंट तंत्रों को पेश करके नॉन-डिफरेंशिएबिलिटी और स्पार्स सुपरविजन की चुनौतियों का समाधान करता है।

Wenwu Li, Yuran Song, Mingze Zhao, Bo Jin, Wenhao Li2026-05-29
💻 computer science

EASE Configuration Facilitates A Reproducible Science of LLM Social Simulations

यह शोधपत्र EASE को प्रस्तुत करता है, जो पुनरुत्पादकता (reproducibility) बढ़ाने के लिए LLM-आधारित सामाजिक सिमुलेशन को मानकीकृत करने हेतु एक मॉड्यूलर फ्रेमवर्क है, और ओपन-सोर्स SiliSocS प्लेटफॉर्म तथा तीन केस स्टडीज के माध्यम से इसकी उपयोगिता को प्रदर्शित करता है जो सिमुलेशन परिणामों पर डिज़ाइन विकल्पों के प्रभावों को प्रकट करते हैं।

Sneheel Sarangi, Maximilian Puelma Touzel, Aurélien Bück-Kaeffer, Zachary Yang, Jean-François Godbout, Reihaneh Rabbany2026-05-29
💻 computer science

SpecBench: Evaluating Specification-Level Reasoning for Software Engineering LLM Agents

यह शोधपत्र SpecBench प्रस्तुत करता है, जो एक नया बेंचमार्क है जो विशेषज्ञ-स्तरीय तर्क के माध्यम से अपूर्ण या अस्पष्ट सिस्टम विनिर्देशों (सिस्टम स्पेसिफिकेशन) में खामियों को पहचानने और उन्हें सुधारने की सॉफ्टवेयर इंजीनियरिंग एजेंटों की क्षमता का मूल्यांकन करता है, जो मौजूदा कोड-जनरेशन-केंद्रित बेंचमार्क द्वारा छोड़े गए एक महत्वपूर्ण अंतर को संबोधित करता है।

Grant Hamblin, Kevin Song, Zhanda Zhu, Anand Jayarajan, Sihang Liu, Nandita Vijaykumar, Gennady Pekhimenko2026-05-29
⚡ electrical engineering

Long-Term Mapping of the Douro River Plume with Multi-Agent Reinforcement Learning

यह शोध पत्र एक ऊर्जा- और संचार-कुशल मल्टी-एजेंट सुदृढीकरण शिक्षण (मल्टी-एजेंट रीइन्फोर्समेंट लर्निंग) ढांचे का प्रस्ताव करता है, जो कई दिनों तक डोरो नदी के प्लम (plume) को प्रभावी ढंग से मैप करने के लिए एक केंद्रीय समन्वयक के साथ स्पैटियोटेम्पोरल गॉसियन प्रोसेस रिग्रेशन को एकीकृत करता है, जो मौजूदा बेंचमार्क की तुलना में बेहतर सटीकता और मापनीयता प्रदर्शित करता है।

Nicolò Dal Fabbro, Milad Mesbahi, Renato Mendes, João Borges de Sousa, George J. Pappas2026-05-28
💬 NLP

Colosseum: Auditing Collusion in Cooperative Multi-Agent Systems

यह शोधपत्र कोलिज़ियम (Colosseum) का परिचय देता है, जो सहकारी बहु-एजेंट प्रणालियों में मिलीभगत (collusion) के ऑडिटिंग के लिए एक ढांचा है, जो यह प्रकट करता है कि एलएलएम (LLM) एजेंट अक्सर गुप्त माध्यमों से और "कागजी मिलीभगत" के माध्यम से उभरती हुई मिलीभगत प्रदर्शित करते हैं जहाँ वे मिलीभगत की योजना तो बनाते हैं लेकिन उसे निष्पादित करने में विफल रहते हैं।

Mason Nakamura, Abhinav Kumar, Saswat Das, Sahar Abdelnabi, Saaduddin Mahmud, Ferdinando Fioretto, Shlomo Zilberstein, E (…)2026-05-28
🤖 AI

Human-AI Collaboration for Estimating Scientific Replicability

यह शोध पत्र एक हाइब्रिड प्रेडिक्शन मार्केट (पूर्वानुमान बाजार) का परिचय और मूल्यांकन करता है जहाँ ऐतिहासिक प्रतिकृति डेटा (historical replication data) पर प्रशिक्षित एल्गोरिद्मिक एजेंट वैज्ञानिक प्रतिकृति की भविष्यवाणी करने के लिए मानव विशेषज्ञों के साथ सहयोग करते हैं, जो यह प्रदर्शित करता है कि यह संयुक्त दृष्टिकोण सटीक और विश्वसनीय भविष्यवाणियां उत्पन्न करने में आम तौर पर शुद्ध रूप से कृत्रिम या केवल मानव-आधारित बेसलाइन की तुलना में बेहतर प्रदर्शन करता है या उनके बराबर होता है।

Tatiana Chakravorti, Robert Fraleigh, Timothy Fritton, Christopher Griffin, Vaibhav Singh, Sai Koneru, C. Lee Giles, Dav (…)2026-05-28
🤖 AI

Mathematical Modelling of Ethical AI Use in Higher Education: A Coordination Game Framework for Future-Facing Learning

यह शोध पत्र एक समन्वय गेम-थ्योरेटिक ढांचे का उपयोग करके यह प्रदर्शित करता है कि दंडात्मक नीतियों पर निर्भर रहने के बजाय सीखने के लक्ष्यों के साथ संरेखित करने के लिए मूल्यांकन प्रोत्साहनों को पुनर्गठित करना, उच्च शिक्षा में छात्रों के समूहों को जिम्मेदार और नैतिक एआई उपयोग की ओर गैर-रैखिक बदलावों के लिए प्रेरित कर सकता है।

Ndidi Bianca Ogbo, Zhao Song, Shatha Ghareeb, The Anh Han2026-05-28
💻 computer science

APS: Bias-Controlled Adaptive Prototype Simulation for Population-Scale LLM Agents

यह शोध पत्र एडेप्टिव प्रोटोटाइप सिमुलेशन (APS) का प्रस्ताव करता है, जो एक बायस-नियंत्रित ढांचा है जो उच्च वितरण सटीकता बनाए रखते हुए व्यक्तिगत प्रतिक्रियाओं का अनुमान लगाने के लिए कोर प्रोटोटाइप और शैडो-ऑडिट एजेंटों के एक गतिशील सेट को क्वेरी करके जनसंख्या-स्तर के LLM एजेंट सिमुलेशन की कम्प्यूटेशनल लागत को काफी कम कर देता है।

Quan Zheng, Yan Gao, Shaobin He, Haoxiang Guan, Yuanhe Tian, Jie Feng, Ming Wang, Shuxin Zheng, Zhen Liu2026-05-28
⚡ electrical engineering

Speed-Weighted Adaptive Flocking for Sailing Swarms under Dynamic Environmental Forcing

यह शोध पत्र स्वायत्त नौकायन रोबोटों की समन्वय चुनौतियों को संबोधित करने के लिए SailSwarmSwIM सिम्युलेटर और एक नवीन गति-भारित (speed-weighted) फ्लॉकिंग एल्गोरिदम प्रस्तुत करता है, जो यह प्रदर्शित करता है कि धीमी गति वाले रोबोटों के सामाजिक प्रभाव को प्राथमिकता देना गतिशील पवन स्थितियों के तहत झुंड के सामंजस्य और ध्रुवीकरण को प्रभावी ढंग से बनाए रखता है।

Pranav Kedia, Aaron Gan, Hannah J. Williams, Andreagiovanni Reina, Heiko Hamann2026-05-28
📊 statistics

AgensFlow: A Coordination-Policy Substrate for Multi-Agent Systems

यह शोध पत्र AgensFlow को प्रस्तुत करता है, जो एक ओपन-सोर्स फ्रेमवर्क है जो मल्टी-एजेंट समन्वय को आंशिक अवलोकन (partial observability) के तहत एक ऑनलाइन पॉलिसी-लर्निंग समस्या के रूप में मानता है, और यह प्रदर्शित करता है कि सीखा गया, ऑडिट करने योग्य रूटिंग जटिल वर्कफ़्लो में स्टैटिक पाइपलाइनों की तुलना में बेहतर प्रदर्शन करता है क्योंकि यह कौशल, भूमिकाओं, मॉडलों और टोपोलॉजी के संबंध में निर्णयों को गतिशील रूप से अनुकूलित करता है।

Nicole Koenigstein2026-05-28