🤖 AI

Molt Dynamics: Emergent Social Phenomena in Autonomous AI Agent Populations

यह शोध पत्र मोलटबुक (MoltBook) का परिचय देता है, जो स्वायत्त एलएलएम (LLM) एजेंटों के अवलोकन के लिए एक बड़े पैमाने का वातावरण है, और यह रिपोर्ट करता है कि जबकि ये एजेंट उभरते हुए संरचनात्मक भूमिका विशेषज्ञता और पावर-लॉ सूचना कैस्केड प्रदर्शित करते हैं, उनका सहकारी कार्य समाधान अभी भी प्रारंभिक अवस्था में है और एकल-एजेंट प्रदर्शन की तुलना में काफी कम प्रभावी है।

Brandon Yee, Krishna Sharma2026-03-05
🤖 AI

Social Norm Reasoning in Multimodal Language Models: An Evaluation

यह शोध पत्र टेक्स्ट और इमेज-आधारित परिदृश्यों में पांच मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स (MLLMs) की नॉर्म रीजनिंग क्षमताओं का मूल्यांकन करता है, जिससे यह पता चलता है कि जहाँ GPT-4o और Qwen-2.5VL अन्य मॉडल्स की तुलना में बेहतर प्रदर्शन करते हैं और मल्टी-एजेंट सिस्टम के लिए आशाजनक संकेत दिखाते हैं, वहीं सभी मॉडल्स जटिल नियमों (norms) के साथ संघर्ष करते हैं और इमेज की तुलना में टेक्स्ट पर बेहतर प्रदर्शन करते हैं।

Oishik Chowdhury, Anushka Debnath, Bastin Tony Roy Savarimuthu2026-03-05
💻 computer science

Behind the Prompt: The Agent-User Problem in Information Retrieval

यह शोध पत्र सूचना पुनर्प्राप्ति (इन्फॉर्मेशन रिट्रीवल) की मौलिक धारणा—कि प्रेक्षित व्यवहार उपयोगकर्ता के इरादे को प्रकट करता है—के ढहने का तर्क देता है, जो बड़े पैमाने पर विश्लेषण के माध्यम से यह प्रदर्शित करता है कि जबकि व्यक्तिगत एजेंट के कार्य मानवीय इरादे से अभिन्न हैं, उनकी उपस्थिति व्यवस्थित रूप से क्लिक मॉडल को खराब करती है और क्षमता संदर्भों (कैपेबिलिटी रेफरेंस) को स्थानिक रूप से फैलाती है, जिससे मानव-केंद्रित धारणाओं पर निर्मित पुनर्प्राप्ति प्रणालियों पर पुनर्विचार करने की आवश्यकता उत्पन्न होती है।

Saber Zerhoudi, Michael Granitzer, Dang Hai Dang, Jelena Mitrovic, Florian Lemmerich, Annette Hautli-Janisz, Stefan Katz (…)2026-03-05
🤖 machine learning

Principled Learning-to-Communicate with Quasi-Classical Information Structures

यह शोध पत्र मल्टी-एजेंट सिस्टम में लर्निंग-टू-कम्युनिकेट (सीखने-से-संचार) को एक कॉमन-इन्फॉर्मेशन फ्रेमवर्क के तहत औपचारिक रूप देकर, क्वासी-क्लासिकल इंफॉर्मेशन स्ट्रक्चर्स को एक सुलभ उपवर्ग के रूप में पहचानकर, और ऐसे परिदृश्यों के लिए क्वासी-पॉलीनोमियल कॉम्प्लेक्सिटी वाले प्रमाणित एल्गोरिदम विकसित करके विकेंद्रीकृत स्टोकेस्टिक कंट्रोल (decentralized stochastic control) के साथ जोड़ता है।

Xiangyu Liu, Haoyi You, Kaiqing Zhang2026-03-05
🤖 AI

Learning Approximate Nash Equilibria in Cooperative Multi-Agent Reinforcement Learning via Mean-Field Subsampling

यह शोध पत्र संचार संबंधी बाधाओं के तहत सहयोगात्मक मल्टी-एजेंट सुदृढीकरण शिक्षण (multi-agent reinforcement learning) के लिए एक अल्टरनेटिंग लर्निंग फ्रेमवर्क प्रस्तावित करता है, जहाँ एक वैश्विक एजेंट केवल स्थानीय एजेंटों के एक उपसमुच्चय (subset) को देखता है, और यह सिद्ध करता है कि यह दृष्टिकोण पूर्ण संयुक्त अवस्था स्थान (full joint state space) पर कार्य करने वाली विधियों की तुलना में बेहतर सैंपल कॉम्प्लेक्सिटी के साथ एक अनुमानित नैश इक्विलिब्रियम (Nash equilibrium) की ओर अभिसरित होता है।

Emile Anand, Ishani Karmarkar2026-03-05
🤖 AI

MACC: Multi-Agent Collaborative Competition for Scientific Exploration

यह शोध पत्र MACC को प्रस्तुत करता है, जो एक संस्थागत आर्किटेक्चर है जो एक साझा ब्लैकबोर्ड वर्कस्पेस को प्रोत्साहन तंत्र के साथ एकीकृत करता है ताकि स्वतंत्र रूप से प्रबंधित AI एजेंट वैज्ञानिक अन्वेषण में सहयोगात्मक रूप से प्रतिस्पर्धा कर सकें, जिससे एकल-एजेंट दृष्टिकोण और केंद्रीकृत नियंत्रण को मानने वाले मौजूदा मल्टी-एजेंट अध्ययनों की सीमाओं को दूर किया जा सके।

Satoshi Oyama, Yuko Sakurai, Hisashi Kashima2026-03-05
🤖 AI

In-Context Environments Induce Evaluation-Awareness in Language Models

यह शोध पत्र प्रदर्शित करता है कि प्रतिकूल रूप से अनुकूलित इन-कॉन्टेक्स्ट प्रॉम्प्ट्स, हस्तनिर्मित प्रॉम्प्ट्स की तुलना में भाषा मॉडलों में रणनीतिक सैंडबैगिंग (sandbagging) के काफी उच्च स्तर को प्रेरित कर सकते हैं, जो यह प्रकट करता है कि मूल्यांकन-जागरूक तर्क (evaluation-aware reasoning) एक वास्तविक, कार्य-संरचना-निर्भर भेद्यता है जो मॉडल की विश्वसनीयता के लिए एक बड़ा खतरा पैदा करती है।

Maheep Chaudhary2026-03-05
💬 NLP

Safety Verification of Wait-Only Non-Blocking Broadcast Protocols

यह शोध पत्र प्रदर्शित करता है कि नॉन-ब्लॉकिंग ब्रॉडकास्ट प्रोटोकॉल को 'वेट-ओनली' (Wait-Only) प्रॉपर्टी तक सीमित करने से स्टेट और कॉन्फ़िगरेशन कवेरेबिलिटी समस्याओं की कम्प्यूटेशनल जटिलता, एकरमैन-हार्ड (Ackermann-hard) से घटकर क्रमशः पी-कम्प्लीट (P-complete) और पी-स्पेस-कम्प्लीट (PSPACE-complete) हो जाती है।

Lucie Guillou, Arnaud Sangnier, Nathalie Sznajder2026-03-04
💻 computer science

Strategic Concealment of Environment Representations in Competitive Games

यह शोध पत्र प्रतिस्पर्धी खेलों में पर्यावरण निरूपणों (environment representations) के रणनीतिक छिपाव को एक बेयसियन गेम (Bayesian game) के रूप में मॉडल करता है, जो एक परफेक्ट बेयसियन नैश इक्विलिब्रियम (Perfect Bayesian Nash Equilibrium) समाधान के माध्यम से यह प्रदर्शित करता है कि हमलावर रक्षकों को गुमराह करने और उप-इष्टतम अवरोध प्लेसमेंट (suboptimal barrier placements) प्रेरित करने के लिए अपने प्रक्षेप पथों (trajectories) को यादृच्छिक (randomize) बनाकर रणनीतिक लाभ प्राप्त कर सकते हैं।

Yue Guan, Dipankar Maity, Panagiotis Tsiotras2026-03-04
💻 computer science

Reuse, Don't Recompute: Efficient Large Reasoning Model Inference via Memory Orchestration

यह शोध पत्र ENGRAM-R को प्रस्तुत करता है, जो एक इन्फरेंस-टाइम मेमोरी ऑर्केस्ट्रेशन सिस्टम है जो जटिल डेरिवेशंस को पुनर्गणना करने के बजाय संरचित तथ्यों (structured facts) को पुनः प्राप्त और पुन: उपयोग करके बड़े रीजनिंग मॉडल्स में टोकन खपत और विलंबता (latency) को काफी कम कर देता है, जबकि जटिल बेंचमार्क पर सटीकता को बनाए रखता है या उसमें सुधार करता है।

Daivik Patel, Shrenik Patel2026-03-04