🤖 AI

Route, Communicate, and Reason: Gated Routing and Adaptive Depth for Efficient Multi-Agent Reasoning

यह शोधपत्र GRADE को प्रस्तुत करता है, जो एक पदानुक्रमित मल्टी-एजेंट सिस्टम है जो एजेंट चयन, तर्क की गहराई और संचार को गतिशील रूप से अनुकूलित करने के लिए सीखे गए गेटिंग मैकेनिज्म और एक नवीन क्रिटिक-मुक्त प्रशिक्षण एल्गोरिदम का उपयोग करता है, जिससे मौजूदा बेसलाइनों की तुलना में काफी कम सक्रिय कंप्यूट के साथ जटिल बेंचमार्क पर बेहतर प्रदर्शन प्राप्त होता है।

Sudipto Ghosh, Tanmoy Chakraborty2026-07-14
🤖 AI

How Do Practitioners Build SE Agents? Insights from a Mixed-Methods Study

100 पेशेवरों के एक मिश्रित-पद्धति अध्ययन के माध्यम से, यह शोध पत्र प्रकट करता है कि सॉफ्टवेयर इंजीनियरिंग एजेंटों का निर्माण कोडिंग से हटकर आवश्यकताओं और समन्वय जैसी गैर-कोडिंग गतिविधियों की ओर विकास संबंधी बाधाओं को स्थानांतरित कर देता है, जिससे एक मूल्यांकन-संचालित वर्कफ़्लो को बढ़ावा मिलता है जो एक सात-चरणीय प्रक्रिया और अविश्वसनीय मूल्यांकन संकेतों एवं बोध ऋण (comprehension debt) जैसी चुनौतियों द्वारा अभिलक्षित है।

Yunbo Lyu, David Williams, Jieke Shi, Zhensu Sun, Chao Peng, Zhou Yang, Federica Sarro, David Lo2026-07-14
🤖 AI

Toward Contemplative LLM: A Modular Framework for Evaluating and Enhancing LLM Alignment in Mental Health

यह शोध पत्र एक मॉड्यूलर, विस्तार योग्य मूल्यांकन ढांचे को प्रस्तुत करता है जिसे चिंतनशील सिद्धांतों के माध्यम से लार्ज लैंग्वेज मॉडल संरेखण (alignment) का व्यवस्थित रूप से आकलन करने और उसे बढ़ाने के लिए डिज़ाइन किया गया है, जो प्रारंभ में मानसिक स्वास्थ्य अनुप्रयोगों को लक्षित करता है जबकि सुदृढ़ मानव-एआई पारिस्थित प्रणालियों के अंतःविषय अनुसंधान के लिए एक डोमेन-अज्ञेय दृष्टिकोण प्रदान करता है।

Asher Sprigler, Yang-Yang Feng, Iftach Amir, Jonathan E. Bogard, Todd S Braver, Yi Ding, David Kinney, Yixue Zhao2026-07-14
🤖 AI

First-Order Modal Logic in HOL: Deep and Shallow Embeddings with Automated Faithfulness (Extended Preprint)

यह शोध पत्र तीन विशिष्ट एम्बेडिंग्स प्रदान करके, क्वांटिफायर के लिए आवश्यक प्रतिस्थापन तंत्र विकसित करके, और पूर्ण डोमेन पर डीप वैलिडिटी को मिनिमल-शैलो व्याख्याओं के साथ सुसंगत बनाने के लिए डाउनवर्ड लोवेनहाइम-स्कोलेम प्रमेय को मैकेनाइज करके, इसाबेल/एचओएल (Isabelle/HOL) के भीतर प्रपोजिशनल से फर्स्ट-ऑर्डर मोडल लॉजिक तक डीप-एंड-शैलो एम्बेडिंग कार्यप्रणाली का विस्तार करता है।

Christoph Benzmüller, Daniel Kirchner2026-07-14
🤖 AI

SETA: Scaling Environments for Terminal Agents

यह शोध पत्र SETA को पेश करता है, जो सत्यापन योग्य टर्मिनल वातावरण उत्पन्न करने के लिए एक स्केलेबल फ्रेमवर्क है जो अपने प्रकार का सबसे बड़ा ओपन-सोर्स डेटासेट (SETA-Env) बनाता है, जिससे Qwen3-8B जैसे RL-प्रशिक्षित मॉडल टर्मिनल एजेंट बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त करने में सक्षम होते हैं।

Qijia Shen, Zhiqi Huang, Vamsidhar Kamanuru, Aznaur Aliev, Jay Rainton, Ahmed Awelkair, Zhichen Zeng, Jiajun Li, Shi Don (…)2026-07-14
⚡ electrical engineering

Learning Linear Temporal Specifications from Demonstrations with Uncertainty

यह शोध पत्र हैमिंग दूरी (Hamming distance) के माध्यम से ट्रेस अनिश्चितता को मॉडल करके और समस्या को सूडो-बुलियन ऑप्टिमाइज़ेशन (Pseudo-Boolean Optimization) में बदलकर, अनिश्चित प्रदर्शनों (demonstrations) से न्यूनतम लीनियर टेम्पोरल लॉजिक (LTL) विनिर्देशों को सीखने के लिए एक नवीन रूपरेखा प्रस्तुत करता है, जिससे शोर वाली स्थितियों में ग्राउंड-ट्रुथ सूत्रों को पुनः प्राप्त करने में मौजूदा विधियों से बेहतर प्रदर्शन किया जा सके।

Parastou Fahim, Constantino Lagoa, Rômulo Meira-G'oes2026-07-14
🤖 AI

CGS: Configurable Graph Summarization with Bounded Neighborhood Loss and Query Support

यह शोध पत्र CGS का प्रस्ताव करता है, जो एक नवीन कॉन्फ़िगर करने योग्य ग्राफ़ सारांशीकरण ढांचा (framework) है जो लॉसलेस परिणामों या सीमित पड़ोस हानि (neighborhood loss) के साथ कई ग्राफ़ प्रश्नों का समर्थन करने के लिए सामान्य पड़ोस वाले नोड्स को एकत्रित करके संक्षिप्त सारांश उत्पन्न करता है, जबकि उपयोगकर्ताओं को सहने योग्य त्रुटि प्रकारों और थ्रेशोल्ड को अनुकूलित करने की अनुमति देता है।

Shubhadip Mitra, Sona Elza Simon, C Oswald, Arnab Bhattacharya, Arindam Pal2026-07-14
🤖 AI

EquiFusion: Kinematics-Agnostic Human Motion Prediction via Equivariant Latent Diffusion

EquiFusion एक परम्यूटेशन इक्विवैरिएंट लेटेंट डिफ्यूजन आर्किटेक्चर का उपयोग करने वाला पहला किनेमैटिक्स-अज्ञेय मानव गति भविष्यवाणी मॉडल पेश करता है जो कंकाल की कनेक्टिविटी को एक स्पष्ट इनपुट के रूप में मानता है, जिससे उत्कृष्ट क्रॉस-डेटासेट सामान्यीकरण, ज़ीरो-शॉट क्षमताएं, और पिछले तरीकों की तुलना में काफी अधिक दक्षता के साथ अत्याधुनिक प्रदर्शन सक्षम होता है।

Cecilia Curreli, Florian Hofherr, Dominik Muhle, Abhishek Saroha, Riccardo Marin, Daniel Cremers2026-07-14
🤖 AI

Think When It Matters: Conditional VLM Reasoning for Social Navigation with RL Policies

यह शोध पत्र HUMA को प्रस्तुत करता है, जो एक हाइब्रिड आर्किटेक्चर है जो वास्तविक समय में, सामाजिक रूप से जागरूक मोबाइल रोबोट नेविगेशन को सक्षम करने के लिए कुशल सुदृढीकरण शिक्षण (reinforcement learning) नीतियों को सशर्त विजन-लैंग्वेज मॉडल तर्क के साथ गतिशील रूप से संयोजित करता है, जो कार्य सफलता में महत्वपूर्ण सुधार करता है और मानव टकरावों को कम करता है।

Ali Ahmadi, Hamed Rahimi, Adrien Jacquet Cretides, Marie Samson, Mahdi Khoramshahi, Mohamed Chetouani2026-07-14
📊 statistics

Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies

यह शोधपत्र नियतकालिक नीतियों (deterministic policies) के साथ विस्तारित मीन फील्ड कंट्रोल (mean field control) के लिए एक मॉडल-मुक्त, निरंतर-समय एक्टर-क्रिटिक सुदृढीकरण शिक्षण ढांचे का प्रस्ताव करता है, जो माप व्युत्पन्न (measure derivatives) से जुड़े एक परिष्कृत पॉलिसी ग्रेडिएंट फॉर्मूला का लाभ उठाता है ताकि उन समस्याओं के लिए कुशल और सुदृढ़ समाधान सक्षम किए जा सकें जहाँ गतिकी (dynamics) और पुरस्कार संयुक्त अवस्था-क्रिया वितरण (joint state-action distribution) पर निर्भर करते हैं।

Ziheng Cheng, Xin Guo, Huyên Pham, Yufei Zhang2026-07-14