💻 computer science

Reconstructing Network Outbreaks under Group Surveillance

यह शोध पत्र समूह निगरानी डेटा से बीमारी के प्रकोप के पुनर्निर्माण के लिए NP-कठिन (NP-hard) POOLCASCADE समस्या को प्रस्तुत करता है, प्रतिबंधित सेटिंग्स में भी इसकी कम्प्यूटेशनल जटिलता को सिद्ध करता है, और ग्रुप स्टेनर ट्री (Group Steiner Tree) और लीनियर प्रोग्रामिंग पर आधारित सन्निकटन एल्गोरिदम (approximation algorithms) प्रस्तावित करता है जो मौजूदा व्यक्तिगत-परीक्षण बेसलाइन से बेहतर प्रदर्शन करते हैं।

Ritwick Mishra, Abhijin Adiga, Anil Vullikanti2026-02-13
🤖 AI

Distributionally Robust Cooperative Multi-Agent Reinforcement Learning via Robust Value Factorization

यह शोध पत्र डिस्ट्रीब्यूशनली रोबस्ट IGM (DrIGM) प्रस्तुत करता है, जो एक नवीन सिद्धांत और संबंधित वैल्यू-फैक्टरिज़ेशन फ्रेमवर्क है जो अनिश्चित वातावरण में सहकारी मल्टी-एजेंट सुदृढीकरण शिक्षण की विश्वसनीयता को बढ़ाने के लिए विकेंद्रीकृत ग्रीडी कार्यों को रोबस्ट टीम-इष्टतम संयुक्त कार्यों के साथ संरेखित करता है, जिससे बिना किसी प्रति-एजेंट रिवॉर्ड शेपिंग की आवश्यकता के आउट-ऑफ-डिस्ट्रीब्यूशन प्रदर्शन में सुधार होता है।

Chengrui Qu, Christopher Yeh, Kishan Panaganti, Eric Mazumdar, Adam Wierman2026-02-13
💻 computer science

Counterfactual Conditional Likelihood Rewards for Multiagent Exploration

यह शोध पत्र काउंटरफैक्चुअल कंडिशनल लाइकलीहुड (CCL) रिवार्ड्स पेश करता है, जो एक नवीन विधि है जो व्यक्तिगत एजेंटों को टीम के संयुक्त अन्वेषण में उनके अद्वितीय योगदान के आधार पर स्कोर करके मल्टी-एजेंट अन्वेषण को बेहतर बनाती है, जिससे स्पार्स-रिवॉर्ड, समन्वय-गहन डोमेन में रेडंडेंसी कम होती है और लर्निंग की गति तेज होती है।

Ayhan Alp Aydeniz, Robert Loftin, Kagan Tumer2026-02-13
🤖 AI

Multi UAVs Preflight Planning in a Shared and Dynamic Airspace

यह शोध पत्र DTAPP-IICR का प्रस्ताव करता है, जो एक स्केलेबल और डिलीवरी-टाइम के प्रति सचेत प्राथमिकता आधारित नियोजन ढांचा है जो गतिशील, साझा शहरी हवाई क्षेत्र में बड़े पैमाने पर UAV बेड़े के लिए कुशल प्रीफ्लाइट प्लानिंग को सक्षम करने हेतु एक नवीन 4D सिंगल-एजेंट प्लानर को पुनरावृत्ति संघर्ष समाधान के साथ जोड़ता है।

Amath Sow, Mauricio Rodriguez Cesen, Fabiola Martins Campos de Oliveira, Mariusz Wzorek, Daniel de Leng, Mattias Tiger (…)2026-02-13
🤖 machine learning

Convex Markov Games and Beyond: New Proof of Existence, Characterization and Learning Algorithms for Nash Equilibria

यह शोध पत्र युग्मित ऑक्यूपेंसी मेजर्स (coupled occupancy measures) वाले मल्टी-एजेंट सिस्टम को मॉडल करने के लिए जनरल यूटिलिटी मार्कोव गेम्स (GUMGs) का परिचय देता है, जो फिक्स्ड-पॉइंट डायनेमिक्स के माध्यम से नैश इक्विलिब्रियम (Nash equilibria) के अस्तित्व को सिद्ध करता है, एक पॉलिसी ग्रेडिएंट थ्योरम व्युत्पन्न करता है, और पोटेंशियल एवं कॉमन-इंटरेस्ट सेटिंग्स दोनों में लर्निंग एल्गोरिदम के लिए अभिसरण गारंटी (convergence guarantees) स्थापित करता है।

Anas Barakat, Ioannis Panageas, Antonios Varvitsiotis2026-02-13
🤖 AI

Games with Payments between Learning Agents

यह शोध पत्र प्रदर्शित करता है कि स्वायत्त शिक्षण एजेंटों (autonomous learning agents) से जुड़े बार-बार खेले जाने वाले खेलों में, स्वार्थी खिलाड़ी एक-दूसरे को रणनीतिक मौद्रिक हस्तांतरण करने के लिए प्रोत्साहित होते हैं, जो आम तौर पर सामूहिक कल्याण को बढ़ाता है लेकिन अत्यधिक मिलीभगत वाले परिणामों की ओर ले जा सकता है जो नीलामीकर्ता के राजस्व को गंभीर रूप से कम कर देते हैं।

Yoav Kolumbus, Joe Halpern, Éva Tardos2026-02-12
💻 computer science

Simplification of Robotic System Model Analysis by Petri Net Meta-Model Property Transfer

यह शोध पत्र एक पदानुक्रमित पेट्री नेट मेटा-मॉडल से गुणों को विशिष्ट सिस्टम मॉडलों में स्थानांतरित करके रोबोटिक सिस्टम डिज़ाइन को त्वरित करने और कम्प्यूटेशनल जटिलता को कम करने की एक विधि प्रस्तावित करता है, जिससे पूरे सिस्टम के बजाय केवल कार्य-निर्भर घटकों का विश्लेषण करना संभव हो जाता है।

Maksym Figat, Cezary Zieliński2026-02-12
💬 NLP

SCALE: Towards Collaborative Content Analysis in Social Science with Large Language Model Agents and Human Intervention

यह शोध पत्र SCALE को प्रस्तुत करता है, जो एक नवीन मल्टी-एजेंट फ्रेमवर्क है जो टेक्स्ट कोडिंग, चर्चा और गतिशील कोडबुक विकास में मानव-समान प्रदर्शन प्राप्त करने के लिए एलएलएम (LLM) एजेंटों को मानवीय हस्तक्षेप के साथ जोड़कर सहयोगात्मक सामाजिक विज्ञान सामग्री विश्लेषण का अनुकरण करता है।

Chengshuai Zhao, Zhen Tan, Chau-Wai Wong, Xinyan Zhao, Tianlong Chen, Huan Liu2026-02-12
💻 computer science

On Qualitative Preference in Alternating-time Temporal Logic with Strategy Contexts

यह शोध पत्र प्लेज़ (plays) पर बाइनरी प्रेफरेंस (binary preferences) जोड़कर स्ट्रैटेजी कॉन्टेक्स्ट्स (strategy contexts) के साथ अल्टरनेटिंग-टाइम टेम्पोरल लॉजिक (ATL) के एक विस्तार का प्रस्ताव करता है, जो गेम इक्विलिब्रिया (game equilibria) के बारे में एल्गोरिद्मिक तर्क के लिए इन प्रेफरेंसों को समाप्त करने और लॉजिक को क्वांटिफाइड कंप्यूटेशन ट्री लॉजिक (QCTL) में मैप करने के लिए ट्रांसलेशन तकनीकें प्रदान करता है।

Dimitar P. Guelev2026-02-12
🤖 AI

Convergence and Connectivity: Dynamics of Multi-Agent Q-Learning in Random Networks

यह शोध पत्र नेटवर्क पॉलीमैट्रिक्स खेलों में मल्टी-एजेंट Q-लर्निंग के अभिसरण (convergence) की जांच करता है, जो अन्वेषण दरों (exploration rates), प्रतिफल (payoffs) और अंतःक्रिया संभावनाओं (interaction probabilities) के बीच परस्पर क्रिया का विश्लेषण करके अर्दोस-रेनी (Erdős-Rényi) और स्टोकेस्टिक ब्लॉक रैंडम नेटवर्क मॉडल के भीतर एक अद्वितीय संतुलन तक पहुँचने के लिए पर्याप्त स्थितियाँ स्थापित करता है।

Dan Leonte, Aamal Hussain, Raphael Huser, Francesco Belardinelli, Dario Paccagnan2026-02-12