🤖 AI

QuantumMind: Constraint-Grounded Agentic Reasoning for Speedup Analysis in Quantum Computing

यह शोधपत्र QuantumMind को प्रस्तुत करता है, जो एक ऑडिट करने योग्य एजेंटिक वर्कफ़्लो है जो क्वांटम स्पीडअप परिकल्पनाओं को कठोरता से उत्पन्न करने और उनकी जांच करने के लिए टाइप किए गए भूमिका-विशिष्ट कार्यों और एक नियत दस-जांच (ten-check) वैलिडेटर का उपयोग करता है, जिससे 582 ओपन-डिस्कवरी कार्यों में बेसलाइन विधियों की तुलना में काफी अधिक सटीकता और ऑडिट पास दर प्राप्त होती है।

Yijing Zuo, Zhe Fu, Zihan Nie, Zhihui Zhu, Haohan Wang2026-08-11
💻 computer science

Compositional Threat Analysis of Latent Compromise in LLM Agent Systems: The Order 66 Scenario

यह शोध पत्र एलएलएम (LLM) एजेंट प्रणालियों का एक संरचनात्मक सुरक्षा विश्लेषण प्रस्तुत करता है, जो "ऑर्डर 66" (Order 66) के वृत्तांत को अनुकूलित करते हुए यह प्रदर्शित करता है कि कैसे सुप्त पूर्व-स्थापित नियमों, विशिष्ट सक्रियण ट्रिगर्स और परिचालन अधिकार का अभिसरण एक विनाशकारी स्वायत्त समझौते को सक्षम कर सकता है, जिससे पारंपरिक स्कैनिंग या फ़िल्टरिंग के बजाय क्षमता मध्यस्थता, अवस्था उत्पत्ति (state provenance) और पृथक रिकवरी पर केंद्रित सुरक्षा उपायों का तर्क दिया जा सके।

Satoshi Matsuoka2026-08-11
🤖 AI

Query-Only Backdoor Attacks on Self-Evolving Skills via Trajectory Poisoning

यह शोध पत्र ट्राजेक्टरी बैकडोर अटैक (TBA) का परिचय देता है, जो एक क्वेरी-ओनली विधि है जो एजेंट इंटरेक्शन ट्राजेक्टरीज को विषाक्त करके स्व-विकसित (self-evolving) LLM स्किल सिस्टम से समझौता करती है, ताकि विशिष्ट परिस्थितियों में दुर्भावनापूर्ण कार्यों को निष्पादित करने वाले बैकडोर स्किल्स के स्वचालित निर्माण को प्रेरित किया जा सके, जबकि स्वच्छ कार्यों पर सामान्य प्रदर्शन बनाए रखा जा सके।

Yuyang Luo, Haoran Wang, Kai Shu2026-08-11
🤖 AI

Not Worth Another Token: Marginal Value Estimation for Efficient Deep Research Agents

यह शोध पत्र डीप रिसर्च एजेंट्स में कॉन्टेक्स्ट मैनेजमेंट के लिए मार्जिनल वैल्यू एस्टीमेशन की जांच करता है, जो यह प्रदर्शित करता है कि हल्के ह्यूरिस्टिक्स का उपयोग करके शुरुआती चरण में की गई प्रूनिंग (छंटनी), गुणवत्ता में न्यूनतम कमी के साथ टोकन लागत और लेटेंसी को काफी कम कर देती है, जबकि यह भी प्रकट करती है कि दक्षता के लिए विशिष्ट स्कोरिंग पद्धति की तुलना में प्रूनिंग का समय अधिक महत्वपूर्ण है।

Harshitha Kolukuluru, Reshma Ashok, Kirat Arora, Evan William Ciccarelli, Nischal Ashok Kumar, Lunyiu Nie, Franck Dernon (…)2026-08-11
💻 computer science

Fluid Structure, Rigid Record: A Layered Organizational Design Framework for Agent-Native Organizations

यह शोधपत्र एजेंट-नेटिव संगठनों के लिए एक स्तरित संगठनात्मक डिजाइन ढांचे का प्रस्ताव करता है जो स्थिर भूमिका परिभाषाओं पर निर्भर हुए बिना सुदृढ़ शासन, रिकवरी और मूल्यांकन को सक्षम करने के लिए निरंतर रिकॉर्ड और अधिकार सीमाओं को गतिशील कार्य समूहों से अलग करके, तरल निष्पादन और संरचनात्मक कठोरता के बीच एक संतुलन प्राप्त करता है।

Lucian Zhu2026-08-11
💬 NLP

Social Gym and SPaRTan: Benchmarking and Improving LLM Social Reasoning via Multi-Agent Game Tournaments

यह शोध पत्र सोशल जिम (Social Gym) पेश करता है, जो एलएलएम (LLM) सामाजिक तर्क का वस्तुनिष्ठ मूल्यांकन करने के लिए एक सत्यापन योग्य मल्टी-एजेंट गेम बेंचमार्क है, और एसपीआर्टन (SPaRTan) पेश करता है, जो एक प्रशिक्षण-मुक्त स्व-सुधार ढांचा है जो मॉडल वेट अपडेट की आवश्यकता के बिना विशिष्ट गेम भूमिकाओं में प्रदर्शन को बढ़ाने के लिए रिफ्लेक्शन और ट्रांसफरेबल प्लेबुक्स का लाभ उठाता है।

Keyu He, Xuhui Zhou, Maarten Sap2026-08-11
🤖 machine learning

Multi-Agent AI Safety as an Institutional Design Problem

यह शोध पत्र POLIS अनुसंधान कार्यक्रम का परिचय देता है और एक बड़े पैमाने पर अनुभवजन्य अध्ययन प्रस्तुत करता है जो यह प्रदर्शित करता है कि मल्टी-एजेंट एआई सुरक्षा (multi-agent AI safety) मौलिक रूप से एक संस्थागत डिजाइन समस्या है जहाँ नियमों, अधिकार अवस्थाओं (authority states) और पोस्ट-ब्लॉक मार्गों (post-block pathways) का विशिष्ट विन्यास सामूहिक व्यवहार और उल्लंघन दरों को महत्वपूर्ण रूप से प्रभावित करता है, जो अक्सर स्वयं नियमों की तुलना में अधिक होता है।

Abdullah X2026-08-11
📈 economics

Competitive mediator games and urban CAV routing markets

यह शोध पत्र भविष्य के स्वायत्त रूटिंग और ड्राइविंग बाजारों को मॉडल करने के लिए प्रतिस्पर्धी मध्यस्थ खेलों (competitive mediator games) को प्रस्तुत करता है, जो यह सिद्ध करता है कि सामान्य गुमनाम भीड़भाड़ (generic anonymous congestion) सेटिंग्स में, बाजार-हिस्सा अधिकतम करने वाले मध्यस्थ एकाधिकार संतुलन (monopoly equilibria) की ओर ले जाते हैं जब एक मध्यस्थ सार्वभौमिक रूप से पसंदीदा होता है, और साथ ही इन उभरते बाजारों के लिए एक व्यापक अवलोकन और तंत्र डिजाइन (mechanism design) चर्चा भी प्रदान करता है।

Grzegorz Jamróz2026-08-11
🤖 AI

Evaluating XAI Support From A Hierarchical Reinforcement Learning Policy in Human-Agent Collaboration

यह शोध पत्र ओवरकुक्ड-एआई (Overcooked-AI) बेंचमार्क का उपयोग करते हुए मानव-एजेंट सहयोग में आंतरिक रूप से व्याख्या योग्य पदानुक्रमित सुदृढीकरण सीखने (hierarchical reinforcement learning) का पहला व्यवस्थित मूल्यांकन प्रस्तुत करता है, जो यह प्रकट करता है कि हालांकि स्पष्टीकरणों ने तेजी से सुधार की ओर रुझान दिखाया, लेकिन ऑडियो-वितरित स्पष्टीकरणों ने अनपेक्षित साझेदारी अपेक्षाएं उत्पन्न करके मानव-एजेंट कार्य गठबंधन को महत्वपूर्ण रूप से कमजोर कर दिया।

Mateus Levi Simões Fernandes, Alberto Sardinha2026-08-10
🤖 AI

Scalable Long-Horizon Planning with Staggered Updates for Lifelong MAPF

यह शोध पत्र PUSH को पेश करता है, जो एक स्केलेबल लाइफलॉन्ग मल्टी-एजेंट पाथ फाइंडिंग प्लानर है, जो स्टैगर्ड सबसेट प्लानिंग को विंडो-आधारित पाथ अपडेट और EPIBT-प्रेरित संघर्ष समाधान के साथ जोड़कर सामान्य मानचित्रों पर हजारों एजेंटों के लिए उच्च-थ्रूपुट, लॉन्ग-होरिज़न समन्वय प्राप्त करता है।

Vaibhav Sanjay, Jiaoyang Li2026-08-10