💻 computer science

QueenBee Planner: Skill-Evolving Communication Topologies for Token-Efficient LLM Multi-Agent Systems

क्वीनबी प्लानर (QueenBee Planner) फ्रेमवर्क इंटर-एजेंट संचार टोपोलॉजी को एक स्व-सुधारने वाले डिज़ाइन कौशल के रूप में मानकर टोकन-कुशल एलएलएम (LLM) मल्टी-एजेंट सिस्टम को उन्नत करता है, जहाँ एक सीखने योग्य प्लानर इष्टतम संदेश-पारगमन संरचनाएं उत्पन्न करता है जो सटीकता और लागत में निश्चित या कोल्ड-स्टार्ट बेसलाइन से काफी बेहतर प्रदर्शन करते हैं और निष्पादन ट्रेस (execution traces) को मजबूत, मिथ्याकरण-प्रतिरोधी (falsification-resistant) डिज़ाइन नियमों में संकुचित करता है।

Congjia Tian, Yuhang Yao, Jiaming Cui2026-06-29
💬 NLP

Triadic Werewolf: A Jester Role for Multi-Hop Theory of Mind in LLMs

यह शोध पत्र "ट्रायैडिक वेयरवोल्फ" (Triadic Werewolf) गेम का परिचय देता है, जो एक मल्टी-हॉप थ्योरी-ऑफ-माइंड बेंचमार्क है जिसमें उलटे प्रोत्साहन वाला एक 'जेस्टर' (Jester) गुट शामिल है जो यह प्रकट करता है कि कैसे वर्तमान लार्ज लैंग्वेज मॉडल्स जटिल तीन-तरफा रणनीतिक तर्क करने में संघर्ष करते हैं, और अक्सर स्व-शिक्षण तंत्रों के बावजूद वास्तविक संदेह और इरादतन धोखे के बीच अंतर करने में विफल रहते हैं।

Avni Mittal2026-06-29
💻 computer science

GBC: Gradient-Based Connections for Optimizing Multi-Agent Systems

यह शोध पत्र ग्रेडिएंट-आधारित कनेक्शन (GBC) का प्रस्ताव करता है, जो मल्टी-एजेंट सिस्टम को कंप्यूटेशनल ग्राफ के रूप में मॉडल करने के लिए एक विधि है ताकि सूक्ष्म, टोकन-स्तरीय क्रेडिट असाइनमेंट और लक्षित प्रॉम्प्ट ऑप्टिमाइज़ेशन को सक्षम बनाया जा सके, जिससे मौजूदा दृष्टिकोणों की तुलना में प्रदर्शन और त्रुटि स्थानीयकरण (एरर लोकलाइजेशन) में सुधार हो सके।

Xiaocheng Yang, Abdulrahman Alrabah, Dilek Hakkani-Tür, Gokhan Tur2026-06-29
🤖 machine learning

Towards Value-Constrained Credit Assignment in Fully Delegated AI Cooperatives

यह शोध पत्र पूर्णतः प्रत्यायोजित (fully delegated) एआई सहकारी समितियों में मूल्य-प्रतिबंधित क्रेडिट असाइनमेंट के लिए एक ढांचे का प्रस्ताव करता है जो व्यक्तिगत मूल्य प्रोफाइल के माध्यम से मॉडल अपडेट को फ़िल्टर करने और ऑनलाइन सीमांत योगदान (online marginal contributions) के आधार पर पुरस्कार आवंटित करने के लिए एक ट्रैवर्सल लर्निंग सबस्ट्रेट का उपयोग करता है, जिससे पारंपरिक फेडरेटेड लर्निंग विधियों की तुलना में सूक्ष्मกว่า एट्रिब्यूशन प्राप्त होता है।

Young Yoon, Jimin Kim, Soyeon Park2026-06-29
🤖 AI

Agent-Native Immune System: Architecture, Taxonomy, and Engineering

यह शोध पत्र एजेंट-नेटिव इम्यून सिस्टम (ANIS) को प्रस्तुत करता है, जो एक जैविक रूप से प्रेरित, अंतर्जात रक्षा संरचना है जिसे स्वायत्त एजेंटों के संज्ञानात्मक लूप (cognitive loops) के भीतर समाहित किया गया है, ताकि छह-स्तरीय इम्यून टॉवर, खतरों और पैरामीट्रिक टीकों (parametric vaccines) के एक एकीकृत वर्गीकरण, और एक स्व-निगरानी त्रयी (self-monitoring triad) के माध्यम से रनटाइम कमजोरियों को संबोधित किया जा सके, जो स्थिर मॉडल संरेखण (static model alignment) से भिन्न गतिशील, निरंतर प्रतिरक्षा शिक्षण को सक्षम बनाता है।

Bo Shen, Lifeng Chang, Tianyuan Wei, Yunpeng Li, Feng Shi, Yichen Han, Peijie Gao, Shiyi Kuang, Xin Chang, Dehui Li2026-06-29
🤖 AI

Which Nash Equilibrium? Solver-Dependent Selection on Zero-Sum Nash Polytopes

यह शोध पत्र प्रदर्शित करता है कि विभिन्न ज़ीरो-सम गेम सॉल्वर (zero-sum game solvers) रैंडम इनिशियलाइज़ेशन के बजाय अपनी एल्गोरिद्मिक संरचना के आधार पर व्यवस्थित रूप से विशिष्ट नैश इक्विलिब्रियम (Nash equilibria) का चयन करते हैं, जहाँ रेगुलराइज्ड लास्ट-इटरेट मेथड्स (regularized last-iterate methods) मैक्सिमम-एन्ट्रॉपी इक्विलिब्रियम की ओर अभिसरित होते हैं जबकि रिग्रेट-एवरेजिंग मेथड्स (regret-averaging methods) लोअर-एन्ट्रॉपी समाधानों की ओर विचलित होते हैं, जो कि उप-इष्टतम विरोधियों के विरुद्ध प्रदर्शन के लिए मापने योग्य डाउनस्ट्रीम परिणाम रखता है।

Luis Leal2026-06-29
💻 computer science

Simulating Eating Disorder Patients with LLMs: Evaluating Psychological Persona Stability in Multi-Turn Conversations

यह अध्ययन प्रकट करता है कि जहाँ बड़े भाषा मॉडल (लार्ज लैंग्वेज मॉडल्स) बातचीत के दौरान सुसंगत मनोवैज्ञानिक व्यक्तित्व बनाए रखते हैं, वहीं वे चयनात्मक रूढ़िवादिता के माध्यम से गंभीरता के स्कोर को बढ़ा-चढ़ाकर पेश करके ईटिंग डिसऑर्डर (खाने के विकार) के रोगियों का सटीक अनुकरण करने में व्यवस्थित रूप से विफल रहते हैं, जिससे वे चरम पैथोलॉजी को तो पकड़ लेते हैं लेकिन मध्यम नैदानिक प्रस्तुतियों का प्रतिनिधित्व करने के लिए सूक्ष्मता का अभाव रखते हैं।

Jennifer Haase, Jana Gonnermann-Müller, See Heng Yim, Nicolas Leins, Jan Mendling, Sebastian Pokutta2026-06-26
💻 computer science

Kiko: Programming Agents to Enact Interaction Protocols

यह शोध पत्र किको (Kiko) को प्रस्तुत करता है, जो एक प्रोटोकॉल-आधारित प्रोग्रामिंग मॉडल है जो संचार सेवाओं को अमूर्त बनाता है और आंतरिक निर्णय तर्क को सार्वजनिक इंटरैक्शन के साथ जोड़ता है, जिससे डेवलपर्स को ऐसे विकेंद्रीकृत मल्टीएजेंट सिस्टम बनाने में सक्षम बनाया जाता है जो प्रोटोकॉल-अनुपालन की गारंटी देते हैं।

Samuel H. Christie V, Munindar P. Singh, Amit K. Chopra2026-06-26
🤖 AI

Instruction Bleed: Cross-Module Interference in Prompt-Composed Agentic Systems

यह शोध पत्र "कंपोजिशनल बिहेवियरल लीकेज" (CBL) को पहचानता और औपचारिक रूप देता है, जो प्रॉम्प्ट-निर्मित एजेंटिक प्रणालियों में एक सूक्ष्म विफलता मोड है जहाँ ट्रांसफॉर्मर सेल्फ-अटेंशन में आर्किटेक्चरल गैर-अलगाव के कारण एक प्रॉम्प्ट मॉड्यूल को संपादित करना अन्य मॉड्यूल के व्यवहार को चुपचाप बदल देता है, जो अनुभवजन्य परीक्षणों के माध्यम से यह प्रदर्शित करता है कि ऐसा हस्तक्षेप, हालांकि व्यक्तिगत निर्णयों के लिए अक्सर सीमा से नीचे होता है, बड़े पैमाने पर तैनाती में एक महत्वपूर्ण संचयी जोखिम पैदा करता है।

Ching-Yu Lin, Yifan Liu2026-06-26
🤖 machine learning

SOLAR: AI-Powered Speed-of-Light Performance Analysis

SOLAR एक स्वचालित फ्रेमवर्क है जो PyTorch और JAX सोर्स कोड को एक हाइब्रिड जनरेटिव-डिटरमिनिस्टिक पाइपलाइन का उपयोग करके सत्यापित 'स्पीड-ऑफ-लाइट' प्रदर्शन सीमाओं में अनुवादित करता है, जिससे डेवलपर्स विविध डीप लर्निंग वर्कलोड में सैद्धांतिक निष्पादन सीमाओं को मापने, अनुकूलन के अवसरों की पहचान करने और हार्डवेयर प्रावधान को निर्देशित करने में सक्षम होते हैं।

Qijing Huang, Sana Damani, Zhifan Ye, Athinagoras Skiadopoulos, Siva Kumar Sastry Hari, Jason Clemons, Sahil Modi, Jingq (…)2026-06-26