🤖 machine learning

Picking the Right Specialist: Attentive Neural Process-based Selection of Task-Specialized Models as Tools for Agentic Healthcare Systems

यह शोध पत्र ToolSelect को प्रस्तुत करता है, जो एक अटेंटिव न्यूरल प्रोसेस-आधारित सेलेक्टर है जो एजेंटिक हेल्थकेयर सिस्टम के लिए एक विषम पूल से अनुकूल रूप से इष्टतम कार्य-विशिष्ट मॉडल का चयन करता है, जिसे एक व्यापक चेस्ट एक्स-रे वातावरण पर नव-स्थापित ToolSelectBench के माध्यम से मान्य किया गया है।

Pramit Saha, Joshua Strong, Mohammad Alsharid, Divyanshu Mishra, J. Alison Noble2026-02-17
💻 computer science

Learning Large-Scale Competitive Team Behaviors with Mean-Field Interactions and Online Opponent Modeling

यह शोध पत्र MF-MAPPO प्रस्तुत करता है, जो बड़े पैमाने पर ज़ीरो-सम टीम खेलों के लिए डिज़ाइन किया गया PPO का एक स्केलेबल मीन-फील्ड विस्तार है, जो ऑनलाइन प्रतिद्वंद्वी मॉडलिंग और ग्रेडिएंट-रेगुलराइज्ड प्रशिक्षण के माध्यम से जटिल, आंशिक रूप से अवलोकन योग्य वातावरणों में मौजूदा विधियों से बेहतर प्रदर्शन करते हुए इंट्रा-टीम सहयोग को इंटर-टीम प्रतिस्पर्धा के साथ प्रभावी ढंग से संयोजित करता है।

Bhavini Jeloka, Yue Guan, Panagiotis Tsiotras2026-02-16
🤖 AI

OptiML: An End-to-End Framework for Program Synthesis and CUDA Kernel Optimization

OptiML एक एंड-टू-एंड फ्रेमवर्क है जो प्रारंभिक संश्लेषण के लिए मिxture-of-thoughts जनरेटर को एक खोज-आधारित ऑप्टिमाइज़र के साथ जोड़कर उच्च-प्रदर्शन वाले CUDA कर्नेल उत्पन्न और अनुकूलित करता है, जो अधिकतम प्रदर्शन के लिए कोड को व्यवस्थित रूप से परिष्कृत करने हेतु मोंटे कार्लो ट्री सर्च (Monte Carlo Tree Search) और हार्डवेयर प्रोफाइलर फीडबैक का उपयोग करता है।

Arijit Bhattacharjee, Heng Ping, Son Vu Le, Paul Bogdan, Nesreen K. Ahmed, Ali Jannesari2026-02-16
⚡ electrical engineering

Interference-Robust Non-Coherent Over-the-Air Computation for Decentralized Optimization

यह शोध पत्र एक इंटरफेरेंस-रोबस्ट नॉन-कोहेरेंट ओवर-द-एयर (IR-NCOTA) योजना प्रस्तावित करता है जो समन्वित रैंडम फ्रेम रोटेशन और स्यूडो-रैंडम पायलटों का उपयोग करके बाहरी हस्तक्षेप को शून्य-माध्यम वितरण (zero-mean distribution) में परिवर्तित करता है, जिससे निष्पक्ष सर्वसम्मति अनुमानों को संरक्षित किया जा सके और विकेंद्रीकृत अनुकूलन कार्यों में अभिसरण (convergence) सुनिश्चित किया जा सके।

Nicolò Michelusi2026-02-16
💻 computer science

Theory of Mind Guided Strategy Adaptation for Zero-Shot Coordination

यह शोध पत्र एक थ्योरी ऑफ माइंड-गाइडेड एडेप्टिव एनसेम्बल एजेंट प्रस्तावित करता है जो टीममेट के इरादों का अनुमान लगाने के लिए एक एनसेम्बल से सबसे उपयुक्त नीति को गतिशील रूप से चुनने हेतु, ओवरकुक्ड (Overcooked) वातावरण में स्टैटिक बेस्ट-रिस्पॉन्स बेसलाइन की तुलना में बेहतर ज़ीरो-शॉट समन्वय प्रदर्शन प्राप्त करता है।

Andrew Ni, Simon Stepputtis, Stefanos Nikolaidis, Michael Lewis, Katia P. Sycara, Woojun Kim2026-02-16
🤖 AI

Bench-MFG: A Benchmark Suite for Learning in Stationary Mean Field Games

यह शोध पत्र Bench-MFG प्रस्तुत करता है, जो एक व्यापक बेंचमार्क सुइट है जिसमें एक समस्या वर्गीकरण (problem taxonomy), यादृच्छिक इंस्टेंस जनरेशन (random instance generation), और विविध शिक्षण एल्गोरिदम शामिल हैं ताकि स्टेशनरी डिस्क्रीट-टाइम, डिस्क्रीट-स्पेस मीन फील्ड गेम्स में विधियों के मूल्यांकन और तुलना को मानकीकृत किया जा सके।

Lorenzo Magnino, Jiacheng Shen, Matthieu Geist, Olivier Pietquin, Mathieu Laurière2026-02-16
💻 computer science

Normative Feeling: Socially Patterned Affective Mechanisms

यह शोधपत्र एजेंट-आधारित मॉडलिंग का उपयोग यह प्रदर्शित करने के लिए करता है कि मानद दंड तंत्र, शुद्ध प्रतिस्पर्धा के विपरीत, उन मनोदशा-आधारित भावनात्मक प्रतिक्रियाओं के विकास को प्रेरित करते हैं जो संसाधन संरक्षण को बढ़ावा देने और सांस्कृतिक प्रतिमानों को मनोवैज्ञानिक प्रवृत्तियों में स्थापित करने के लिए अंतर्निहित सामाजिक संकेतों के रूप में कार्य करते हैं।

Stavros Anagnou, Daniel Polani, Christoph Salge2026-02-13
🤖 AI

Parallelism Meets Adaptiveness: Scalable Documents Understanding in Multi-Agent LLM Systems

यह शोध पत्र एक स्केलेबल मल्टी-एजेंट एलएलएम (LLM) फ्रेमवर्क प्रस्तावित करता है जो स्थिर वर्कफ़्लो की सीमाओं को दूर करने के लिए डायनेमिक टास्क रूटिंग, द्विदिश फीडबैक और पैरेलल एजेंट कॉम्पिटिशन को एकीकृत करके जटिल डोमेन में डॉक्यूमेंट अंडरस्टैंडिंग को बढ़ाता है।

Chengxuan Xia, Qianye Wu, Sixuan Tian, Yilun Hao2026-02-13
🤖 machine learning

Modal Logical Neural Networks

यह शोध पत्र मोडल लॉजिकल न्यूरल नेटवर्क्स (MLNNs) को प्रस्तुत करता है, जो एक अवकलनीय न्यूरोसिम्बोलिक ढांचा है जो आवश्यकता और संभावना के बारे में तर्क करने में सक्षम बनाने के लिए संभव दुनियाओं के बीच सुलभता संबंधों (accessibility relations) को सीखने या लागू करने के लिए डीप लर्निंग को क्रिप्के सिमेंटिक्स (Kripke semantics) के साथ एकीकृत करता है, जिससे विविध कार्यों में तार्किक निरंतरता और व्याख्यात्मकता में वृद्धि होती है।

Antonin Sulc2026-02-13
💻 computer science

Semantic Fusion: Verifiable Alignment in Decentralized Multi-Agent Systems

यह शोध पत्र 'सिमेंटिक फ्यूजन' (Semantic Fusion) प्रस्तुत करता है, जो विकेंद्रीकृत मल्टी-एजेंट सिस्टम के लिए एक औपचारिक ढांचा है जो स्थानीय ऑन्टोलॉजी-आधारित सत्यापन और एक बिसिमिलरेशन प्रमेय (bisimulation theorem) के माध्यम से सत्यापन योग्य वैश्विक सुसंगतता को सक्षम बनाता है, जिससे सुरक्षा और जीवंतता (liveness) गुणों को बिना किसी केंद्रीकृत नियंत्रण के व्यक्तिगत एजेंटों से संपूर्ण प्रणाली तक सुदृढ़ता से उन्नत करना संभव हो जाता है।

Sofiya Zaichyk2026-02-13