⚡ electrical engineering

Adjacency-Based Spectral Proxy Control of Mobile Communication Agents

यह शोध पत्र A-Fiedler का प्रस्ताव करता है, जो मोबाइल संचार एजेंटों के लिए एक वितरित नियंत्रण रणनीति है जो स्थानीय संचार बाधाओं के तहत नेटवर्क प्रदर्शन में तुलनीय परिणाम प्राप्त करने के साथ-साथ मजबूती में महत्वपूर्ण सुधार करने के लिए गणनात्मक रूप से महंगे फिडलर वेक्टर (Fiedler vector) को प्रमुख आसन्नता आइजनवेक्टर (dominant adjacency eigenvector) से बदल देता है।

Mariana del Castillo, Federico Larroca2026-08-17
🤖 AI

From Passive Delegates to Strategic Negotiators: Reinforcing Social Reasoning in Small Language Models with SocialRL

यह शोधपत्र SocialRL प्रस्तुत करता है, जो एक ऐसा प्रशिक्षण नुस्खा (training recipe) है जो सामाजिक तर्क और थ्योरी-ऑफ-माइंड स्कैफोल्डिंग को सुदृढ़ करके छोटे भाषा मॉडलों को रणनीतिक वार्ताकार में बदल देता है, जिससे एक 4B-पैरामीटर वाला मॉडल इन-डोमेन प्रशिक्षण और क्रॉस-डोमेन ट्रांसफर रणनीतियों के माध्यम से विविध वार्ता डोमेन में GPT-5 जैसे बहुत बड़े फ्रंटियर मॉडलों के प्रदर्शन के बराबर या उससे बेहतर प्रदर्शन करने में सक्षम हो जाता है।

Wenyue Hua, Zachary Huang, Tyler Payne, Safoora Yousefi, Saleema Amershi, Asli Celikyilmaz2026-08-17
🔢 mathematics

Optimal Control Strategies for Multi-Agent Sheep Herding

यह शोध पत्र कुत्तों के साथ कई भेड़ों को चराने के लिए इष्टतम नियंत्रण रणनीतियों की जांच करता है, यह प्रदर्शित करते हुए कि जबकि इटरेटिव लीनियर क्वाड्रेटिक रेगुलेटर (iLQR) बाउंड्री वैल्यू या शूटिंग विधियों की तुलना में बेहतर स्केलेबिलिटी प्रदान करता है, यह अत्यधिक गैर-रेखीय (नॉनलीनियर), निकट-समीपवर्ती परिदृश्यों में अभिसरण (कन्वर्जेंस) और स्थिरता के साथ संघर्ष करता है, जो अधिक सुदृढ़ गैर-रेखीय नियंत्रण तकनीकों की आवश्यकता को रेखांकित करता है।

Drake Brown, Trevor Garrity, Daniel Perkins, Davis Hunter, Wyatt Pochman2026-08-14
💻 computer science

Learning Latency-Aware Orchestration for Multi-Agent Systems

यह शोध पत्र LAMaS को पेश करता है, जो एक नवीन ढांचा (framework) है जो प्रशिक्षण के दौरान क्रिटिकल-पाथ क्रेडिट असाइनमेंट के साथ लेटेंसी-अवेयर एक्जीक्यूशन ग्राफ्स को सीखकर और अनुमान (inference) के दौरान अनावश्यक इंटरैक्शन को समाप्त करने के लिए एक हल्के अनुकूलन योग्य नियंत्रक (lightweight adaptive controller) का उपयोग करके मल्टी-एजेंट सिस्टम में एंड-टू-एंड लेटेंसी को कम करता है, जिससे कार्य सटीकता बनाए रखते हुए 50% से अधिक लेटेंसी में कमी आती है।

Xi Shi, Mengxin Zheng, Qian Lou2026-08-14
💰 quantitative finance

EU-ETS under attack? The impact of carbon price suppression on the decarbonization of the power sector

मल्टी-एजेंट सुदृढीकरण शिक्षण (multi-agent reinforcement learning) ढांचे का उपयोग करते हुए इटली की गैस-संचालित बिजली संयंत्रों के लिए कार्बन कीमतों को दबाने की प्रस्तावित 2026 की नीति का विश्लेषण करते हुए, यह अध्ययन पाता है कि हालांकि ऐसे हस्तक्षेप अल्पकालिक लागत राहत प्रदान करते हैं, लेकिन वे अंततः नवीकरables और भंडारण के लिए निवेश प्रोत्साहन को कमजोर करके दीर्घकालिक उत्सर्जन और उपभोक्ता लागत को बढ़ाते हैं, जब तक कि उन्हें एक विरोधाभासी हाइब्रिड बाजार प्रतिमान द्वारा साथ न दिया जाए जो थोक मूल्य संकेतों को हाशिए पर डाल देता है।

Javier Gonzalez-Ruiz, Carlos Rodriguez-Pardo, Alice Di Bella, Paolo Mastropietro, Jose Pablo Chavez-Avila, Massimo Tavon (…)2026-08-14
💻 computer science

Agent Behavioral Contracts II: Certifying Compositional Reliability Without Assuming Independence

यह शोध पत्र प्रदर्शित करता है कि उच्च मॉडल-विशिष्ट सह-विफलता (co-failure) दरों के कारण मल्टी-एजेंट विश्वसनीयता में स्वतंत्रता का मानक अनुमान खतरनाक रूप से त्रुटिपूर्ण है, और यह संयुक्त क्षणों (joint moments) पर रैखिक प्रोग्रामिंग का उपयोग करते हुए एक सुदृढ़, परिमित-नमूना प्रमाणन विधि प्रस्तावित करता है जो स्वतंत्रता संबंधी धारणाओं और अविश्वसनीय फिट किए गए निर्भरता मॉडलों, दोनों के दोषों से बचती है।

Varun Pratap Bhardwaj, Garima Singh, Arun Pratap Bhardwaj2026-08-14
💻 computer science

OGR-MARL: Option-Guided Residual Multi-Agent Reinforcement Learning for Heterogeneous USV Cooperative Pursuit in Constrained Port Waterways

यह शोध पत्र OGR-MARL का प्रस्ताव करता है, जो एक विच्छेदित विकल्प-निर्देशित अवशिष्ट बहु-एजेंट सुदृढीकरण शिक्षण (decoupled option-guided residual multi-agent reinforcement learning) ढांचा है, जो नियम-निर्देशित एजेंटों को सुधारात्मक क्रियाएं सीखने में सक्षम बनाकर सीमित बंदरगाह जलमार्गों में विषम USV सहकारी पीछा करने की क्षमता को बढ़ाता है, जिससे उच्च कैप्चर दर और विभिन्न MARL बैकबोन में ज़ीरो-शॉट सामान्यीकरण प्राप्त होता है।

Mao Jiayang, Wang Lanfeng, Peng Zhao-Han2026-08-14
💻 computer science

LigBench: A Unified and Human-Aligned Benchmark for LLM-based Research Idea Generation

यह शोध पत्र मौजूदा मूल्यांकन विधियों की विखंडन और व्यक्तिपरकता को दूर करने के लिए, LLM-जनित शोध विचारों का मूल्यांकन करने हेतु एक एकीकृत और मानव-संरेखित स्वचालित बेंचमार्क, LigBench, के साथ-साथ युग्मवार निर्णय मॉडल (pairwise judgment models) को प्रशिक्षित करने के लिए PAIR-IQ डेटासेट प्रस्तुत करता है।

Chenrun Wang, Mingxuan Zhu, Tiancheng Huang, Wenjie Li, Yujie Zhang, Zichen Zhu, Zhiying Zou, Kai Yu, Lu Chen2026-08-14
⚡ electrical engineering

Heterogeneity-Aware Belief Synchronization for Semantic Communication in AI-Native 6G Networks

यह शोध पत्र AI-नेटिव 6G नेटवर्क के लिए एक हेटेरोजेनिटी-अवेयर बिलीफ सिंक्रोनाइज़ेशन फ्रेमवर्क का प्रस्ताव करता है जो विविध AI एजेंटों के ज्ञान को संरेखित करने और संयुक्त प्रशिक्षण या होमोजेनियस आर्किटेक्चर की आवश्यकता के बिना कुशल सिमेंटिक कम्युनिकेशन सक्षम करने के लिए एज सर्वरों पर लेटेंट ट्रांसलेशन मॉडल्स का उपयोग करता है।

Muhammad Hannan Akram, Muhammad Abubakar Rashid, Wassi Haider Kabir, Haejoon Jung, Kapal Dev, Syed Ali Hassan2026-08-14
⚡ electrical engineering

Joint Communication-Control Strategy Optimization with Partially Nested Information Structures: The Linear-Quadratic Case

यह शोध पत्र आंशिक रूप से नेस्टेड सूचना संरचनाओं के तहत मल्टी-एजेंट लीनियर-क्वाड्रेटिक प्रणालियों के लिए एक संयुक्त संचार-नियंत्रण अनुकूलन समस्या को औपचारिक रूप देता है, जो नेस्टेडनेस को बनाए रखने की शर्तों को स्थापित करता है और एक डायनेमिक-प्रोग्रामिंग दृष्टिकोण विकसित करता है जो ओपन-लूप और क्लोज्ड-लूप दोनों संचार रणनीतियों के लिए क्लोज्ड-फॉर्म रिक्काटी समीकरण प्रदान करता है।

Haoyi You, Kaiqing Zhang2026-08-14