💻 computer science

Distributionally Robust Markov Games with Average Reward

यह शोध पत्र औसत-पुरस्कार मानदंडों के तहत अपरिवर्तनीय (irreducible) और दुर्बल संचार (weakly communicating) दोनों परिवेशों में वितरण रूप से सुदृढ़ (distributionally robust) मार्कोव खेलों के लिए स्थिर नैश संतुलन (stationary Nash equilibria) के सैद्धांतिक अस्तित्व को स्थापित करता है, साथ ही अभिसारी एल्गोरिदम का प्रस्ताव देता है और उनके डिस्काउंटेड समकक्षों के माध्यम से उनके सन्निकटन (approximation) को प्रदर्शित करता है।

Zachary Roch, Yue Wang2026-06-23
🤖 AI

Infrastructure for the Agentic Web: Gap Analysis and Architecture from the Agentverse Platform

यह शोध पत्र Fetch.ai Agentverse प्लेटफॉर्म का एक व्यवस्थित अंतराल विश्लेषण (gap analysis) प्रस्तुत करता है ताकि महत्वपूर्ण बुनियादी ढांचे की कमियों की पहचान की जा सके और 2030 तक "एजेंटिक वेब" के लिए एक स्केलेबल, एजेंट-नेटिव क्लाउड इंफ्रास्ट्रक्चर के विकास को निर्देशित करने हेतु एक सात-स्तरीय संदर्भ आर्किटेक्चर और पांच विकास पथ प्रस्तावित किए जा सकें।

Robin Dey, Panyanon Viradecha2026-06-23
🤖 AI

Specifying AI-SDLC Processes: A Protocol Language for Human-Agent Boundaries

यह शोध पत्र AI-SDLC प्रक्रियाओं को निर्दिष्ट करने के लिए एक औपचारिक डोमेन-विशिष्ट भाषा का प्रस्ताव करता है जो संरचनात्मक प्रवर्तन प्रिमिटिव्स (structural enforcement primitives) के माध्यम से मानव-एजेंट सीमाओं को परिभाषित करता है, नीति को तंत्र से अलग करता है ताकि सिस्टम विफलता दरों को सीमित किया जा सके और मल्टी-एजेंट सॉफ्टवेयर विकास में कर्तव्यों के पृथक्करण को औपचारिक रूप दिया जा सके।

Ylli Prifti2026-06-23
🤖 AI

PEAR: Permutation-Equivariant Adaptive Routing Multi-Agent Debate

यह शोध पत्र PEAR को प्रस्तुत करता है, जो मल्टी-एजेंट बहसों के लिए एक क्रम-तुल्य (permutation-equivariant) अनुकूली रूटिंग प्रोटोकॉल है जो स्थितिजन्य पूर्वाग्रहों को समाप्त करने और विविध लार्ज लैंग्वेज मॉडल्स में तर्क की सटीकता को महत्वपूर्ण रूप से सुधारने के लिए एजेंटों की भूमिकाओं और विरल टोपोलॉजी (sparse topologies) को गतिशील रूप से पुनर्गठित करता है।

Yang Feng, Ziwei Xu, Xia Hu, Fengxiang He2026-06-23
⚡ electrical engineering

Platooning Connected, Autonomous, and Human-Driven Vehicles: A Deep Reinforcement Learning-based Approach

यह शोध पत्र एक डीप रीइन्फोर्समेंट लर्निंग-आधारित हाइब्रिड प्लूटनिंग नियंत्रण रणनीति प्रस्तावित करता है जो लचीलेपन को बढ़ाने के लिए गैर-कनेक्टेड वाहनों को मिश्रित यातायात में गतिशील रूप से एकीकृत करता है और व्यवधान प्रसार को दबाते हुए यातायात थ्रूपुट और स्थिरता के बीच संतुलन को अनुकूलित करता है।

Zhen Qina, Dong-Fan Xie, Heng Ma, Xiaomei Zhao, Zhengbing He2026-06-23
🤖 AI

Confidence Laundering in Agent Systems: Why Uncertainty Needs a Latent Carrier

यह शोध पत्र "कॉन्फिडेंस लॉन्ड्रिंग" (confidence laundering) को एजेंट प्रणालियों में एक महत्वपूर्ण विफलता मोड के रूप में पहचानता है जहाँ घटक हैंडऑफ के दौरान अपस्ट्रीम अनिश्चितता लुप्त हो जाती है, जिससे सिस्टम-स्तरीय त्रुटि प्रवर्धन होता है, और अधिक रिकवरेबल मल्टी-एजेंट सिस्टम के लिए इंटरफेस के माध्यम से निर्णय की भंगुरता (decision fragility) को बनाए रखने के लिए "लेटेंट अनसर्टेन्टी" (latent uncertainty) को एक तंत्र के रूप में प्रस्तावित करता है।

Kaiwen Shi, Zheyuan Zhang, Han Bao, Colby Nelson, Yanfang Ye2026-06-23
🤖 AI

Process-Reward Tactic Evolution for Long-Horizon Bioinformatics Workflows

यह शोध पत्र प्रोसेस-रिवॉर्ड टैक्टिक इवोल्यूशन (Process-Reward Tactic Evolution) प्रस्तुत करता है, जो एक ऐसा प्रशिक्षण ढांचा है जो सत्यापित गैलेक्सी वर्कफ़्लो निष्पादन ट्रेसेस (Galaxy workflow execution traces) को एक पुन: प्रयोज्य टैक्टिक लाइब्रेरी में संकुचित करता है ताकि मौजूदा बेसलाइनों की तुलना में जटिल, दीर्घकालिक बायोइन्फॉर्मेटिक्स कार्यों को पूरा करने में एलएलएम (LLM) एजेंटों की विश्वसनीयता, जैविक शुद्धता और दक्षता में उल्लेखनीय सुधार किया जा सके।

Lingzhi Yang, Yubo Fan, Song Wu, Gilchan Park2026-06-23
🌀 nonlinear sciences

Artificial collectives of specialists and generalists excel at different tasks

यह शोध पत्र प्रदर्शित करता है कि कृत्रिम समूहों (artificial collectives) का इष्टतम डिज़ाइन एजेंट विशेषज्ञता (विशेषज्ञ बनाम सामान्यज्ञ) को विशिष्ट कार्य गुणों और कम्प्यूटेशनल तर्कसंगतता सीमाओं के साथ मिलान करने पर निर्भर करता है, जो यह प्रकट करता है कि विशेषज्ञ उच्च-आयामी नमूनाकरण (high-dimensional sampling) और बातचीत में उत्कृष्ट होते हैं जबकि सामान्यज्ञ कड़े प्रतिबंधों के तहत सृजन, समन्वय और ग्रेडिएंट अनुमान में बेहतर प्रदर्शन करते हैं।

John Meluso, Laurent Hébert-Dufresne, Christoph Riedl, H. Oliver Gao2026-06-23
🤖 AI

Negative Knowledge as Failure-aware Shared Memory for AutoResearch

यह शोध पत्र एक "नेगेटिव नॉलेज मेमोरी लेयर" (negative knowledge memory layer) प्रस्तुत करता है जो विफल अनुसंधान प्रयासों को संरचित, साझा रिकॉर्ड में परिवर्तित करता है, और यह प्रदर्शित करता है कि इस विफलता-जागरूक ज्ञान को स्पष्ट रूप से बनाए रखना और उपयोग करना, बेसलाइन दृष्टिकोणों की तुलना में PDEs जैसी जटिल वैज्ञानिक समस्याओं को हल करने में AI अनुसंधान एजेंटों के प्रदर्शन और टोकन दक्षता को महत्वपूर्ण रूप से बढ़ाता है।

Hanchun Wang2026-06-23
💻 computer science

Monitoring Diameters of Causal Communication Graph with Spatio-Temporal Logic

यह शोध पत्र muTGL तर्क को विस्तारित करने के लिए एक "स्पेस होराइजन" (space horizon) ऑपरेटर प्रस्तुत करता है, जो मल्टी-एजेंट सिस्टम में दूरी-बद्ध पहुंच (distance-bounded reachability) और संचार श्रृंखला लागतों के सत्यापन को सक्षम बनाता है, और एक केंद्रीकृत ऑफलाइन मॉनिटरिंग एल्गोरिदम प्रदान करता है जिसे सर्वसम्मति-आधारित कार्य आवंटन प्रोटोकॉल पर सत्यापित किया गया है।

Lydia Bakiri, Jérémy Dubut, Sergio Mover2026-06-23