💻 computer science

From Failed Trajectories to Reliable LLM Agents: Diagnosing and Repairing Harness Flaws

यह शोध पत्र HarnessFix को प्रस्तुत करता है, जो एक ट्रेस-निर्देशित (trace-guided) फ्रेमवर्क है जो निष्पादन ट्रेसेस (execution traces) और हार्नेस कोड का विश्लेषण करके एजेंट की विफलताओं का निदान करता है ताकि लक्षित, सत्यापित पैच उत्पन्न किए जा सकें जो कई बेंचमार्क में LLM एजेंट की विश्वसनीयता में महत्वपूर्ण सुधार करते हैं।

Mengzhuo Chen, Junjie Wang, Zhe Liu, Yawen Wang, Qing Wang2026-06-05
💬 NLP

Emergent Language as an Approach to Conscious AI

यह शोध पत्र कृत्रिम चेतना का अध्ययन करने के लिए मल्टी-एजेंट सुदृढीकरण शिक्षण (मल्टी-एजेंट रीइन्फोर्समेंट लर्निंग) में उद्गामी भाषा (इमर्जेंट लैंग्वेज) का उपयोग करते हुए एक जनरेटिव कार्यप्रणाली प्रस्तावित करता है, यह प्रदर्शित करते हुए कि कैसे एजेंट, बिना किसी मानवीय भाषाई पूर्वधारणाओं के, केवल कार्य संबंधी मांगों और पर्यावरणीय सामर्थ्य (एनवायरनमेंटल अफोर्डेंस) द्वारा संचालित होकर, आत्म-संदर्भित संचार और नवीन संज्ञानात्मक संरचनाओं को विकसित कर सकते हैं।

Zengqing Wu, Chuan Xiao2026-06-05✓ Author reviewed
💬 NLP

Solving Zebra Puzzles Using Constraint-Guided Multi-Agent Systems

यह शोध पत्र ZPS प्रस्तुत करता है, जो एक बाधा-निर्देशित (constraint-guided) मल्टी-एजेंट सिस्टम है जो जटिल ज़ेबरा पहेलियों को हल करने के लिए SMT कोड उत्पन्न करने और परिष्कृत करने हेतु लार्ज लैंग्वेज मॉडल्स को एक ऑफ-द-शेल्फ थ्योरम प्रूवर के साथ जोड़ता है, जो स्टैंडअलोन LLMs की तुलना में महत्वपूर्ण सटीकता सुधार प्रदर्शित करता है।

Shmuel Berman, Kathleen McKeown, Baishakhi Ray2026-06-04
💻 computer science

Expected Return Symmetries

यह शोध पत्र "अपेक्षित प्रतिफल समरूपताओं" (expected return symmetries) को प्रस्तुत करता है, जो पारंपरिक परिवेश समरूपताओं को समाहित करने वाला एक व्यापक वर्ग है, जिससे विकेंद्रीकृत बहु-एजेंट परिवेशों में एजेंटों को वास्तविक समरूपताओं के पूर्व ज्ञान की आवश्यकता के बिना बेहतर ज़ीरो-शॉट समन्वय प्राप्त करने में सक्षम बनाया जा सके।

Darius Muglich, Johannes Forkel, Elise van der Pol, Jakob Foerster2026-06-04
💻 computer science

Shift Bribery over Social Networks

यह शोध पत्र सामाजिक नेटवर्क में शिफ्ट रिश्वतखोरी (shift bribery) की कम्प्यूटेशनल जटिलता की जांच करता है, जहाँ प्रभाव एक निर्देशित ग्राफ के माध्यम से प्रसारित होता है, यह स्थापित करते हुए कि यह समस्या सामान्यतः NP-पूर्ण और W[2]-कठिन है, जबकि विशिष्ट ग्राफ संरचनाओं और मतदान नियमों के लिए बहुपद-समय (polynomial-time) और फिक्स्ड-पैरामीटर सुग्राह्य (fixed-parameter tractable) समाधानों की पहचान करता है।

Ashlesha Hota, Susobhan Bandopadhyay, Palash Dey2026-06-04
⚡ electrical engineering

Multi-Agent Temporal Logic Planning via Penalty Functions and Block-Coordinate Optimization

यह शोध पत्र मल्टी-एजेंट सिग्नल टेम्पोरल लॉजिक (STL) प्लानिंग के लिए एक स्केलेबल फ्रेमवर्क प्रस्तावित करता है जो उच्च-आयामी सहयोगात्मक समस्या को स्मूथ पेनल्टी फंक्शन्स का उपयोग करके एक अनकन्स्ट्रेंड ऑप्टिमाइज़ेशन कार्य में परिवर्तित करता है, जिसे फिर अभिसरण और व्यवहार्यता सुनिश्चित करने के लिए टू-लेयर ब्लॉक-कोऑर्डिनेट ग्रेडिएंट डिसेंट स्कीम के माध्यम से कुशलतापूर्वक हल किया जाता है।

Eleftherios E. Vlahakis, Arash Bahari Kordabad, Lars Lindemann, Pantelis Sopasakis, Sadegh Soudjani, Dimos V. Dimarogona (…)2026-06-04
💻 computer science

Token Budgets: An Empirical Catalog of 63 LLM-Agent Budget-Overrun Incidents, with an Affine-Typed Rust Mitigation as a Case Study

यह शोध पत्र 63 LLM-एजेंट टोकन बजट ओवररन का एक अनुभवजन्य कैटलॉग प्रस्तुत करता है और "token-budgets" पेश करता है, जो एक टाइप-सेफ रस्ट (Rust) क्रेट है जो एफ़ाइन ओनरशिप (affine ownership) का लाभ उठाकर कंपाइल टाइम पर गैर-बायपास करने योग्य खर्च की सीमाओं को लागू करता है, जो प्रभावी रूप से उन डेलीगेशन-संबंधित लागत विस्फोटों को रोकता है जो एड-हॉक रनटाइम समाधानों को प्रभावित करते हैं।

Sajjad Khan2026-06-04
🔬 physics

Exploring the Topology and Memory of Consensus: How LLM Agents Agree, Fragment, or Settle When Forming Conventions

यह शोध पत्र प्रदर्शित करता है कि मल्टी-एजेंट एलएलएम (LLM) प्रणालियों में, नेटवर्क टोपोलॉजी द्वारा मेमोरी की गहराई का सर्वसम्मति की गति और विखंडन पर प्रभाव मौलिक रूप से उलट दिया जाता है, जो मेमोरी और संचार संरचनाओं को अलग-थलग अनुकूलित करने के बजाय उन्हें सह-डिज़ाइन करने की एक महत्वपूर्ण आवश्यकता को प्रकट करता है।

Aliakbar Mehdizadeh, Martin Hilbert2026-06-04
💻 computer science

What Makes Majority Illusion Easy to Detect?

यह शोध पत्र सामाजिक नेटवर्क में "बहुमत भ्रम" (majority illusion) का पता लगाने की गणनात्मक जटिलता की जांच करता है, जिसमें यह विश्लेषण किया गया है कि विभिन्न संरचनात्मक गुण उस नेटवर्क विन्यास के निर्धारण की सुगमता को कैसे प्रभावित करते है जहाँ एजेंटों का एक महत्वपूर्ण अंश गलती से अल्पसंख्यक राय को प्रभावी समझने लगता है।

Šimon Schierreich, Ildikó Schlotter2026-06-04
🤖 AI

AgentJet: A Flexible Swarm Training Framework for Agentic Reinforcement Learning

AgentJet एक लचीला, वितरित स्वार्म ट्रेनिंग फ्रेमवर्क है जो हेट्रोजेनियस मल्टी-मॉडल रिइन्फोर्समेंट लर्निंग, फॉल्ट-टॉलरेंट मल्टी-टास्क ट्रेनिंग और लाइव कोड इटरेशन को सक्षम करने के लिए एजेंट निष्पादन को मॉडल अनुकूलन से अलग करता है, जबकि स्वायत्त लॉन्ग-होरिज़न आरएल रिसर्च के लिए एक स्वचालित प्रणाली पेश करता है।

Qingxu Fu, Boyin Liu, Shuchang Tao, Zhaoyang Liu, Bolin Ding2026-06-04