🤖 AI

Loc2Repair: A Framework for Evaluating the Impact of File-Level Issue Localization in Repo-Level LLM Repair

यह शोध पत्र Loc2Repair प्रस्तुत करता है, जो एक मॉड्यूलर मूल्यांकन ढांचा है जो यह प्रदर्शित करता है कि कैसे फ़ाइल-स्तर के इश्यू लोकलाइजेशन (issue localization) को रिपेयर सिंथेसिस (repair synthesis) से अलग करने से रिपॉजिटरी-आधारित स्वचालित मरम्मत प्रणालियों की प्रभावशीलता और दक्षता दोनों में निरंतर सुधार होता है।

Mohammad Nour Al Awad, Sergey Ivanov2026-07-01
🤖 AI

HyPOLE: Hyperproperty-Guided Multi-Agent Reinforcement Learning under Partial Observation

यह शोध पत्र HyPOLE पेश करता है, जो एक नवीन ढांचा है जो आंशिक अवलोकन (partial observability) के तहत मल्टी-एजेंट सुदृढीकरण शिक्षण (Multi-Agent Reinforcement Learning) को निर्देशित करने के लिए HyperLTL-आधारित हाइपरप्रॉपर्टीज का लाभ उठाता है, और केंद्रीकृत प्रशिक्षण एवं विकेंद्रीकृत निष्पादन के एकीकरण के माध्यम से मानक बेंचमार्क पर बेसलाइन्स की तुलना में बेहतर प्रदर्शन प्रदर्शित करता है।

Arshia Rafieioskouei, Tzu-Han Hsu, Matthew Lucas, Borzoo Bonakdarpour2026-07-01
🤖 AI

AgentBound: Verifiable Behavioral Governance for Autonomous AI Agents

AgentBound एक रनटाइम गवर्नेंस फ्रेमवर्क है जो डेलिगेटेड ऑथोराइजेशन, ओनर-साइंड कॉन्स्टिट्यूशंस और साइट कॉन्ट्रैक्ट्स के विरुद्ध प्रस्तावित कार्यों का मूल्यांकन करके स्वायत्त एआई एजेंटों के लिए सत्यापन योग्य व्यवहारिक निगरानी सुनिश्चित करता है ताकि क्रिप्टोग्राफिक रूप से ऑडिट करने योग्य रसीदें उत्पन्न की जा सकें जो स्वतंत्र सत्यापन और जवाबदेही को सक्षम बनाती हैं।

Anuj Kaul, Qianlong Lan, Pranay Gupta2026-07-01
🤖 AI

Beyond Compilation: Evaluating Faithful Natural-Language-to-Lean Statement Formalization

यह शोध पत्र यह तर्क देता है कि प्राकृतिक-भाषा-से-लीन (natural-language-to-Lean) औपचारिकीकरण का मूल्यांकन करने के लिए केवल लीन संकलन दरों (Lean compilation rates) पर निर्भर रहना भ्रामक है क्योंकि सिंटैक्टिक वैधता और सिमेंटिक निष्ठा के बीच एक महत्वपूर्ण अंतर है, और यह एक कठोर मानव-कैलिब्रेटेड सर्वसम्मति मीट्रिक का प्रस्ताव करता है तथा औपचारिक कथन की सटीकता में सुधार के लिए एलैबोरेशन फीडबैक (elaboration feedback) को सबसे महत्वपूर्ण हस्तक्षेप के रूप में पहचानता है।

Ke Zhang, Patricio Gallardo Candela, Sudhir Murthy, Yi Xie, Zhi Wang, Maziar Raissi2026-07-01
🤖 machine learning

OTCache: Optimal Transport for Geometry-Aware Caching in Diffusion Models

OTCache एक प्रशिक्षण-मुक्त ढांचा है जो ऑप्टिमल ट्रांसपोर्ट का उपयोग करके कैशिंग शेड्यूल्स को पॉलिसी स्पेस में एक सुचारू विकास के रूप में मॉडल करके डिफ्यूजन मॉडल सैंपलिंग को तेज करता है, जिससे एक उच्च-फिडेलिटी संदर्भ शेड्यूल और एक अनुकूलित लो-बजट एंकर के बीच इंटरपोलेशन के माध्यम से विभिन्न मॉडलों में महत्वपूर्ण गति और बेहतर फिडेलिटी प्राप्त होती है।

Huanlin Gao, Fang Zhao, Qiang Hui, Fuyuan Shi, Shaoan Zhao, Yantao Li, Chao Tan, Ting Lu, Yuren You, Kai Wang, Shiguo Li (…)2026-07-01
🤖 AI

LabGuard: Grounding Natural-Language Laboratory Rules into Runtime Guards for Embodied Laboratory Agents

LabGuard एक सुरक्षा सुइट है जो एक टाइप किए गए इंटरमीडिएट रिप्रेजेंटेशन, एक बेंचमार्क डेटासेट और एक ग्राउंडिंग मॉडल को पेश करके प्राकृतिक-भाषा प्रयोगशाला नियमों और मशीन-निष्पादनीय बाधाओं के बीच के अंतर को पाटता है, ताकि रनटाइम मॉनिटर तैनात किए जा सकें जो कार्य सफलता को बनाए रखते हुए एम्बोडीड लैब एजेंटों में असुरक्षित घटनाओं को महत्वपूर्ण रूप से कम करते हैं।

Jingpu Yang, Fengxian Ji, Zhengzhao Lai, Zhexuan Cui, Guangxian Ouyang, Qian Jiang, Fan Zhang, Min Peng, Qianqian Xie, P (…)2026-07-01
🤖 AI

OpenLife: Toward Open-World Artificial Life with Autonomous LLM Agents

यह शोध पत्र OpenLife प्रस्तुत करता है, जो एक अवधारणा-प्रमाण (proof-of-concept) ढांचा है जो एलएलएम (LLM) एजेंटों को एक खुले विश्व वातावरण में स्वयं को बनाए रखने में सक्षम करने के लिए अतुल्यकालिक प्रक्रियाओं (asynchronous processes) के एक समाज का उपयोग करता है, जिससे कृत्रिम जीवन के अध्ययन के लिए एक व्यवहार्य नए प्रतिमान के रूप में व्यक्तिवाद, सामाजिक संरचना और स्वयं अर्जित आय जैसे उभरते जीवन-समान गुणों का प्रदर्शन होता है।

Atsushi Masumori, Itsuki Doi, Norihiro Maruyama, Ryosuke Takata, Takashi Ikegami2026-07-01
🤖 machine learning

Knowledge Distillation from Large Reasoning Models to Compact Student Models: A Case Study on the John O Bryan Mathematics Competition

यह शोध पत्र प्रदर्शित करता है कि एक ड्यूल-एजेंट फ्रेमवर्क और अर्ली स्टॉपिंग का उपयोग करके डीपसीक-आर1 (DeepSeek-R1) शिक्षक से डिस्टिल्ड चेन-ऑफ-थॉट डेटा के साथ एक कॉम्पैक्ट क्यूवेन 2.5-7बी (Qwen2.5-7B) स्टूडेंट मॉडल को फाइन-ट्यून करने से जॉन ओ'ब्रायन मैथमेटिक्स कॉम्पिटिशन और मैथ-500 (MATH-500) बेंचमार्क पर इसकी सटीकता में महत्वपूर्ण सुधार होता है, जबकि यह भी प्रकट करता है कि कम प्रतिक्रिया लंबाई का कम तर्क गुणवत्ता के साथ सहसंबंध है।

Gaurab Baral, Aaditya Khanal, Yangyang Tao, Junxiu Zhou2026-07-01
💬 NLP

ADAPT: Attention Dynamics Alignment with Preference Tuning for Faithful MLLMs

यह शोध पत्र ADAPT को प्रस्तुत करता है, जो एक अटेंशन-आधारित फ्रेमवर्क है जो विजुअल एंकर्स, ऑनलाइन करेक्शन मैकेनिज्म और प्रेफरेंस ट्यूनिंग के माध्यम से टेक्स्ट-टू-इमेज क्रॉस-अटेंशन डायनेमिक्स को संरेखित करके मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स में मतिभ्रम (hallucinations) को कम करता है, जिससे सामान्य क्षमताओं को बनाए रखते हुए मतिभ्रम में महत्वपूर्ण कमी आती है।

Zhiyuan Yao, Zheren Fu, Zhixiao Zheng, Jiajun Li, Yi Tu, Zhendong Mao2026-07-01
🤖 AI

MultiUAV-Plat: An LLM-Oriented Platform, Benchmark and Framework for Multi-UAV Collaborative Task Planning

यह शोध पत्र MultiUAV-Plat प्रस्तुत करता है, जो एक हल्का सिमुलेशन प्लेटफॉर्म और व्यापक बेंचमार्क है जिसे वास्तविक बाधाओं के तहत LLM-संचालित मल्टी-UAV सहयोगात्मक कार्य नियोजन को व्यवस्थित रूप से मूल्यांकन करने के लिए डिज़ाइन किया गया है, साथ ही इसमें Agent4Drone फ्रेमवर्क भी शामिल है जो मिशन सफलता दर में मौजूदा बेसलाइनों से काफी बेहतर प्रदर्शन करता है।

Sheng Zhang, Qinglin Li, Yuechao Zang, Xueqin Huang, Yijia Fu, Cheng Zhu2026-07-01