💻 computer science

Emergent Relational Order in LLM Agent Societies: From Collective Affect to Authority Stratification

यह शोध पत्र CAREB-MAS को प्रस्तुत करता है, जो प्रभाव (affect) और सामाजिक पहचान सिद्धांतों पर आधारित एक मल्टी-एजेंट फ्रेमवर्क है, जो यह प्रदर्शित करता है कि फेई ज़ियाओटोंग की 'डिफरेंशियल ऑर्डर' (विभेदक क्रम) की घटनाएँ—जैसे कि संबंधात्मक अधिकार और वंश-आधारित स्तरीकरण—केवल सांस्कृतिक रूप से विशिष्ट होने के बजाय सामान्य सामाजिक तंत्रों के माध्यम से LLM एजेंट समाजों में स्वतः उत्पन्न हो सकती हैं।

Zhiyuan Ji, Xinyu Chen, Ziqi Dai, Shiyun Tang, Chunyu Wei, Yueguo Chen2026-06-24
⚡ electrical engineering

Welfarist Control Design -- How to fulfill the societal mandate in multi-agent control?

यह शोधपत्र बहु-एजेंट नियंत्रण प्रणालियों को डिजाइन करने के लिए एक सिद्धांतपूर्ण ढांचे का प्रस्ताव करता है जो व्यक्तिगत प्राथमिकताओं को उद्देश्यों में एकत्रित करके और ऑनलाइन फीडबैक ऑप्टिमाइजेशन, मार्कोव डिसीजन प्रोसेस और मॉडल प्रेडिक्टिव कंट्रोल के भीतर फीडबैक तंत्रों का उपयोग करके सामाजिक अधिदेशों के अनुरूप है, ताकि दुर्लभ संसाधनों का नैतिक और कुशल आवंटन सुनिश्चित किया जा सके।

Sophie Hall, Kai Zhang, Ilia Shilov, Heinrich H. Nax, Saverio Bolognani2026-06-24
🤖 machine learning

EMAgnet: Parameter-Space EMA Regularization for Policy Gradient Self-Play in Large Games

यह शोध पत्र EMAgnet को प्रस्तुत करता है, जो एक नवीन पॉलिसी ग्रेडिएंट सेल्फ-प्ले पद्धति है जो पिछले पॉलिसी मापदंडों के एक्सपोनेंशियल मूविंग एवरेज का उपयोग करके एक एडेप्टिव रेगुलराइजेशन टारगेट के रूप में यूनिफॉर्म रेगुलराइजेशन में सुधार करती है, जिससे प्रभावी रूप से डोमिनेटेड स्ट्रैटेजीज़ वाले बड़े खेलों में कम एक्सप्लोिटेबिलिटी और बेहतर प्रदर्शन प्राप्त होता है।

Tristan Maidment, JB Lanier, Chase McDonald, Nathan Tsang, Eugene Vinitsky, Roy Fox, Albert Wang, Wesley N. Kerr2026-06-24
🤖 AI

Age of LLM: A Strategic 1v1 Benchmark for Reasoning, Diplomacy and Reliability of Large Language Models under Fog of War

यह शोध पत्र "Age of LLM" प्रस्तुत करता है, जो एक नवीन टर्न-आधारित 1v1 बेंचमार्क है जिसमें फॉग ऑफ वॉर (fog of war), अनियंत्रित कूटनीति और सख्त एक्शन रिलायबिलिटी बाधाएं शामिल हैं ताकि यह मूल्यांकन किया जा सके कि बड़े भाषा मॉडल प्रतिकूल अनिश्चितता के तहत कैसे तर्क करते हैं, धोखा देते हैं और विश्वासों को ट्रैक करते हैं, जिससे यह प्रकट होता है कि परमाणु रणनीतियां हावी रहती हैं जबकि राजनयिक समझौते शायद ही कभी सफल होते हैं।

Arnaud Ricci2026-06-24
🤖 AI

Towards Adaptive Categories: Dimensional Governance for Agentic AI

यह शोध पत्र स्थिर श्रेणीबद्ध शासन से एक गतिशील "आयामी शासन" (डायमेंशनल गवर्नेंस) ढांचे की ओर बदलाव का समर्थन करता है जो मानव-एआई संबंधों में निर्णय लेने के अधिकार, प्रक्रिया स्वायत्तता और जवाबदेही (3As) के तरल वितरण को ट्रैक करता है, जिससे विकसित होते एजेंटिक एआई सिस्टम के लिए अनुकूलन योग्य, पूर्व-सक्रिय जोखिम प्रबंधन सक्षम होता है।

Zeynep Engin, David Hand2026-06-23
💻 computer science

Distributionally Robust Markov Games with Average Reward

यह शोध पत्र औसत-पुरस्कार मानदंडों के तहत अपरिवर्तनीय (irreducible) और दुर्बल संचार (weakly communicating) दोनों परिवेशों में वितरण रूप से सुदृढ़ (distributionally robust) मार्कोव खेलों के लिए स्थिर नैश संतुलन (stationary Nash equilibria) के सैद्धांतिक अस्तित्व को स्थापित करता है, साथ ही अभिसारी एल्गोरिदम का प्रस्ताव देता है और उनके डिस्काउंटेड समकक्षों के माध्यम से उनके सन्निकटन (approximation) को प्रदर्शित करता है।

Zachary Roch, Yue Wang2026-06-23
🤖 AI

Infrastructure for the Agentic Web: Gap Analysis and Architecture from the Agentverse Platform

यह शोध पत्र Fetch.ai Agentverse प्लेटफॉर्म का एक व्यवस्थित अंतराल विश्लेषण (gap analysis) प्रस्तुत करता है ताकि महत्वपूर्ण बुनियादी ढांचे की कमियों की पहचान की जा सके और 2030 तक "एजेंटिक वेब" के लिए एक स्केलेबल, एजेंट-नेटिव क्लाउड इंफ्रास्ट्रक्चर के विकास को निर्देशित करने हेतु एक सात-स्तरीय संदर्भ आर्किटेक्चर और पांच विकास पथ प्रस्तावित किए जा सकें।

Robin Dey, Panyanon Viradecha2026-06-23
🤖 AI

Specifying AI-SDLC Processes: A Protocol Language for Human-Agent Boundaries

यह शोध पत्र AI-SDLC प्रक्रियाओं को निर्दिष्ट करने के लिए एक औपचारिक डोमेन-विशिष्ट भाषा का प्रस्ताव करता है जो संरचनात्मक प्रवर्तन प्रिमिटिव्स (structural enforcement primitives) के माध्यम से मानव-एजेंट सीमाओं को परिभाषित करता है, नीति को तंत्र से अलग करता है ताकि सिस्टम विफलता दरों को सीमित किया जा सके और मल्टी-एजेंट सॉफ्टवेयर विकास में कर्तव्यों के पृथक्करण को औपचारिक रूप दिया जा सके।

Ylli Prifti2026-06-23
🤖 AI

PEAR: Permutation-Equivariant Adaptive Routing Multi-Agent Debate

यह शोध पत्र PEAR को प्रस्तुत करता है, जो मल्टी-एजेंट बहसों के लिए एक क्रम-तुल्य (permutation-equivariant) अनुकूली रूटिंग प्रोटोकॉल है जो स्थितिजन्य पूर्वाग्रहों को समाप्त करने और विविध लार्ज लैंग्वेज मॉडल्स में तर्क की सटीकता को महत्वपूर्ण रूप से सुधारने के लिए एजेंटों की भूमिकाओं और विरल टोपोलॉजी (sparse topologies) को गतिशील रूप से पुनर्गठित करता है।

Yang Feng, Ziwei Xu, Xia Hu, Fengxiang He2026-06-23
⚡ electrical engineering

Platooning Connected, Autonomous, and Human-Driven Vehicles: A Deep Reinforcement Learning-based Approach

यह शोध पत्र एक डीप रीइन्फोर्समेंट लर्निंग-आधारित हाइब्रिड प्लूटनिंग नियंत्रण रणनीति प्रस्तावित करता है जो लचीलेपन को बढ़ाने के लिए गैर-कनेक्टेड वाहनों को मिश्रित यातायात में गतिशील रूप से एकीकृत करता है और व्यवधान प्रसार को दबाते हुए यातायात थ्रूपुट और स्थिरता के बीच संतुलन को अनुकूलित करता है।

Zhen Qina, Dong-Fan Xie, Heng Ma, Xiaomei Zhao, Zhengbing He2026-06-23