⚛️ quantum physics

QBugLM: An Agentic Benchmarking Framework for LLM-based Quantum Software Debugging

यह शोध पत्र QBugLM को प्रस्तुत करता है, जो OpenQASM 3.0 क्वांटम सॉफ्टवेयर की डिबगिंग को स्वचालित करने के लिए एक मल्टी-एजेंट फ्रेमवर्क है, और बेंचमार्किंग के माध्यम से यह प्रदर्शित करता है कि पुनरावृत्त फीडबैक (iterative feedback) और संरचित प्रॉम्प्टिंग (structured prompting), साइलेंट क्वांटम बग्स का पता लगाने और उन्हें ठीक करने की LLMs की क्षमता को महत्वपूर्ण रूप से बढ़ाते हैं।

An B. B. Pham, Hoa T. Nguyen, Muhammad Usman2026-06-08
🤖 AI

Socratic-SWE: Self-Evolving Coding Agents via Trace-Derived Agent Skills

Socratic-SWE एक क्लोज्ड-लूप सेल्फ-इवोल्यूशन फ्रेमवर्क पेश करता है जो एक एजेंट के ऐतिहासिक समाधान ट्रैसेस को संरचित कौशलों में परिवर्तित करता है ताकि लक्षित, सत्यापन योग्य मरम्मत कार्य उत्पन्न किए जा सकें, जिससे निरंतर सुधार सक्षम होता है और निश्चित उत्परिवर्तन प्रक्रियाओं पर निर्भर किए बिना SWE बेंचमार्क पर अत्याधुनिक प्रदर्शन प्राप्त होता है।

Chuan Xiao, Zhengbo Jiao, Shaobo Wang, Wei Wang, Bing Zhao, Hu Wei, Linfeng Zhang, Lin Qu2026-06-08
⚡ electrical engineering

Re-imagining ISO 26262 in the Age of Autonomous Vehicles: Enhancing Controllability through Transferability and Predictability

यह शोध पत्र स्वायत्त वाहनों के लिए ISO 26262 नियंत्रणीयता (Controllability) मानदंड को 'स्थानांतरणीयता' (Transferability) और 'पूर्वानुमेयता' (Predictability) के मापने योग्य आयामों में विभाजित करके उसे पुनर्कल्पित करने का प्रस्ताव देता है, जिससे ड्राइवरलेस सिस्टम में फॉलबैक क्षमताओं और इंटरेक्शन व्यवहारों को परिमाणीकृत और असत्य सिद्ध करने के लिए एक गणितीय ढांचा तैयार होता है।

Chaitanya Shinde, Hadi Hajieghrary, Paul Schmitt, Adam Shoemaker, Bodo Seifert, Steve Kenner2026-06-08
🤖 AI

A Cartography of Open Collaboration in Open Source AI: Mapping Practices, Motivations, and Governance in 14 Open Large Language Model Projects

14 ओपन लार्ज लैंग्वेज मॉडल परियोजनाओं के एक खोजपूर्ण विश्लेषण के माध्यम से, यह शोध पत्र विकास जीवनचक्र (डेवलपमेंट लाइफसाइकिल) के दौरान ओपन सहयोग की विकसित होती प्रथाओं, विविध प्रेरणाओं और विविध शासन संरचनाओं का मानचित्रण करता है, और यह निष्कर्ष निकालता है कि एआई में खुलापन (ओपननेस) एक समान गुण होने के बजाय इस बात का एक उभरता हुआ परिणाम है कि ये परस्पर जुड़े तत्व कैसे व्यवस्थित हैं।

Johan Linåker, Cailean Osborne, Jennifer Ding, Ben Burtenshaw2026-06-05
💻 computer science

Advancing Digital Government: Integrating Open Source Software Enablement Indicators in Maturity Indexes

यह अध्ययन डिजिटल सरकार की परिपक्वता सूचकांकों में ओपन सोर्स सॉफ्टवेयर (OSS) सक्षमता को एकीकृत करने के लिए 14 संकेतकों का एक व्यापक सेट प्रस्तावित करने के लिए 16 डिजिटल रूप से परिपक्व देशों में OSS नीतियों और सहायता तंत्रों का विश्लेषण करता है, जो सार्वजनिक क्षेत्र के परिवर्तन को चलाने में स्पष्ट नीतिगत ढांचे और OSPO जैसे संस्थागत समर्थन की रणनीतिक भूमिका पर प्रकाश डालता है।

Johan Linåker, Sachiko Muto2026-06-05
🤖 AI

Beyond Code Pairs: Dialogue-Based Data Generation for LLM Code Translation

यह शोध पत्र एक स्वचालित, संवाद-आधारित डेटासेट जनरेशन पाइपलाइन प्रस्तुत करता है जो कंपाइलर और रनटाइम फीडबैक के साथ एक दोहरे-LLM क्वेश्चनर-सॉल्वर डिज़ाइन का लाभ उठाता है ताकि सत्यापित कोड अनुवाद और तर्क संबंधी संवाद बनाए जा सकें, जो फोर्ट्रान और CUDA जैसे कम-संसाधन वाले डोमेन में LLMs की कार्यात्मक शुद्धता को महत्वपूर्ण रूप से बढ़ाता है।

Le Chen, Nuo Xu, Winson Chen, Bin Lei, Pei-Hung Lin, Dunzhi Zhou, Rajeev Thakur, Caiwen Ding, Ali Jannesari, Chunhua Lia (…)2026-06-05
🤖 AI

Learning Adaptive Parallel Execution for Efficient Code Localization

FuseSearch एक अनुकूली समानांतर निष्पादन ढांचा (adaptive parallel execution framework) है जो कार्य संदर्भ के आधार पर खोज की चौड़ाई को गतिशील रूप से अनुकूलित करने के लिए दो-चरणीय SFT और RL प्रशिक्षण रणनीति का उपयोग करता है, जिससे SWE-bench Verified पर अत्याधुनिक कोड लोकलाइज़ेशन प्रदर्शन प्राप्त होता है और साथ ही अनावश्यक इनवोकेशन, टोकन उपयोग और निष्पादन समय में महत्वपूर्ण कमी आती है।

Ke Xu, Siyang Xiao, Ming Liang, Yichen Yu, Zhixiang Wang, Jingxuan Xu, Dajun Chen, Wei Jiang, Yong Li2026-06-05
💻 computer science

Evolution of Log-Based Detection Rules in Public Repositories

यह शोध पत्र सार्वजनिक रिपॉजिटरी में लॉग-आधारित डिटेक्शन रूल के विकास का पहला अनुदैर्ध्य विश्लेषण प्रस्तुत करता है, जो यह प्रकट करता है कि नियमों में परिवर्तन मुख्य रूप से गैर-एकदिष्ट (non-monotonic) हैं और स्थिर रूपों की ओर निरंतर अभिसरण के बजाय कवरेज और फॉल्स पॉजिटिव्स के बीच चल रहे परिचालन संबंधी समझौतों को दर्शाते हैं।

Minjun Long, David Evans2026-06-05
💻 computer science

DeployBench: Benchmarking LLM Agents for Research Artifact Deployment

यह शोध पत्र DeployBench प्रस्तुत करता है, जो 51 रिसर्च-आर्टिफैक्ट परिनियोजन (deployment) कार्यों वाला एक बहु-डोमेन बेंचमार्क है जो जटिल, वास्तविक वैज्ञानिक वातावरण स्थापित करने में LLM एजेंटों की क्षमताओं का मूल्यांकन करता है, और यह मुख्य रूप से त्रुटिपूर्ण स्व-समाप्ति तर्क (self-termination logic) के कारण वर्तमान एजेंट प्रदर्शन में महत्वपूर्ण अंतराल को प्रकट करता है।

Yuanli Wang, Yaoyao Qian, Yue Zhang, Hanhan Zhou, Jindan Huang, Tianfu Fu, Qiuyang Mang, Huanzhi Mao, Wenhao Chai, Wendo (…)2026-06-05
💻 computer science

Human oversight of agentic systems in practice: Examining the oversight work, challenges, and heuristics of developers using software agents

17 अनुभवी डेवलपर्स के साथ साक्षात्कार के माध्यम से, यह शोध पत्र स्वायत्त सॉफ़्टवेयर एजेंटों के साथ सहयोग करते समय डेवलपर्स द्वारा नियोजित प्रोएक्टिव (proactive) और रिएक्टिव (reactive) रूपों के निरीक्षण कार्य, संबद्ध चुनौतियों और व्यावहारिक ह्यूरिस्टिक्स (heuristics) का अनुभवजन्य रूप से लक्षण वर्णन करता है, जिससे सैद्धांतिक ढांचों और वास्तविक दुनिया के अभ्यास के बीच के अंतर को पाटा जा सके।

Shipi Dhanorkar, Samir Passi, Mihaela Vorvoreanu2026-06-05