💻 computer science

Connecting the Models: A Global Mega-model of MDE Projects on GitHub

यह शोध पत्र 7,400 से अधिक GitHub प्रोजेक्ट्स से 325,000 मॉडल-ड्रिवन इंजीनियरिंग (MDE) आर्टिफ़ेक्ट्स को माइन करके प्राप्त एक वैश्विक मेगा-मॉडल प्रस्तुत करता है, जिसका उद्देश्य MDE टूल्स और तकनीकों के वास्तविक उपयोग, संयोजन और रखरखाव के अनुभवजन्य विश्लेषण के लिए एक आधारभूत डेटासेट स्थापित करना है।

Jesús Sánchez Cuadrado2026-06-30
💻 computer science

Bash-Commenter: Leveraging Syntax-Aware Preference Optimization to Reinforce Large Language Model for Bash Code Comment Generation

यह शोध पत्र Bash-Commenter को प्रस्तुत करता है, जो एक ऐसी विधि है जो निरंतर प्री-ट्रेनिंग (continual pre-training), सुपरवाइज्ड फाइन-ट्यूनिंग (supervised fine-tuning) और एब्स्ट्रैक्ट सिंटैक्स ट्री (Abstract Syntax Tree) हेरफेर पर आधारित एक नवीन सिंटैक्स-अवेयर प्रेफरेंस ऑप्टिमाइज़ेशन (Syntax-Aware Preference Optimization - SAPO) तकनीक का लाभ उठाती है, ताकि जटिल बाश (Bash) स्क्रिप्ट्स के लिए सटीक और स्वाभाविक कमेंट्स उत्पन्न करने की लार्ज लैंग्वेज मॉडल्स (Large Language Models) की क्षमता को महत्वपूर्ण रूप से बढ़ाया जा सके।

Lei Yu, Jingyuan Zhang, Xin Wang, Li Yang, Fengjun Zhang, Peng Wang, Jia Xu, Jiajia Ma2026-06-30
💻 computer science

SWE-Together: Evaluating Coding Agents in Interactive User Sessions

यह शोध पत्र SWE-Together प्रस्तुत करता है, जो वास्तविक उपयोगकर्ता-एजेंट कोडिंग सत्रों से प्राप्त एक मल्टी-टर्न बेंचमार्क है, जो रिपॉजिटरी की अंतिम शुद्धता और आवश्यक सुधारात्मक फीडबैक टर्न की संख्या दोनों के आधार पर कोडिंग एजेंटों का मूल्यांकन करने के लिए एक रिएक्टिव LLM-आधारित उपयोगकर्ता सिम्युलेटर का उपयोग करता है, जिससे यह पता चलता है कि अधिक शक्तिशाली एजेंट कम हस्तक्षेपों के साथ उच्च सफलता दर प्राप्त करते हैं।

Yifan Wu, Zhuokai Zhao, Songlin Li, Ho Hin Lee, Jiacheng Zhu, Shirley Wu, Tianhe Yu, Serena Li, Lizhu Zhang, Xiangjun Fa (…)2026-06-30
💻 computer science

How do Execution Features Improve Statistical Fault Localization? An Empirical Study

यह अनुभवजन्य अध्ययन प्रदर्शित करता है कि निष्पादन विशेषताओं, जैसे कि डेटा-फ्लो और ब्रांच कंडीशंस के साथ सांख्यिकीय दोष स्थानीयकरण (statistical fault localization) को बढ़ाना, Tests4Py बेंचमार्क में दोष रैंकिंग की सटीकता में महत्वपूर्ण सुधार करता है और डेवलपर निरीक्षण प्रयास को कम करता है।

Marius Smytzek, Andreas Zeller2026-06-30
💻 computer science

PyMETA: A Benchmark Dataset for Hierarchical Student Code Error Classification with Python-Interpreter-Based Labels

यह शोध पत्र PyMETA प्रस्तुत करता है, जो विशेषज्ञ-एनोटेटेड त्रुटि लेबल के साथ 48,646 छात्र पायथन सबमिशन का एक बड़े पैमाने का पदानुक्रमित डेटासेट है, और बहु-स्तरीय कोड त्रुटि वर्गीकरण में फाइन-ट्यून्ड मॉडल्स और प्रॉम्प्टिंग-आधारित LLMs दोनों के प्रदर्शन और सीमाओं का मूल्यांकन करता है।

Chuyue Li, Ziqi Tang, Jingyi Wang, Yu Wu, Kazuma Hashimoto, Lingyu Gao2026-06-30
💻 computer science

An Empirical Study of Fuzz Harness Degradation

गूगल के OSS-Fuzz प्लेटफॉर्म का यह अनुभवजन्य अध्ययन यह प्रकट करता है कि हालांकि ओपन-सोर्स C/C++ परियोजनाओं के लिए फज़ हार्नेस अक्सर बिना किसी स्पष्ट अपडेट के समय के साथ अपनी बग-खोजने की क्षमता और कवरेज बनाए रखते हैं, फिर भी वे परियोजना के विकास के कारण खराब हो सकते हैं, जिससे लेखक ऐसे कारणों की पहचान करने और इस तरह के क्षरण का पता लगाने के लिए उपकरण योगदान करने के लिए प्रेरित हुए हैं।

Philipp Görz, Joschua Schilling, Nicolai Bissantz, Thorsten Holz2026-06-29
💻 computer science

Using Mutation-Analysis to Examine an LLM's Ability to Summarize Code

यह शोध पत्र एलएलएम (LLM) की कोड सारांश उत्पन्न करने की क्षमता का आकलन करने के लिए एक म्यूटेशन-आधारित मूल्यांकन पद्धति प्रस्तुत करता है जो केवल इरादे के बजाय वास्तविक प्रोग्राम व्यवहार को सटीक रूप से दर्शाती है, जिससे यह पता चलता है कि हालांकि मॉडल के आकार के साथ प्रदर्शन में सुधार होता है, लेकिन कोड की जटिलता के साथ सटीकता में महत्वपूर्ण गिरावट आती है और मॉडल अक्सर सूक्ष्म तार्किक परिवर्तनों का पता लगाने में विफल रहते हैं।

Lara Khatib, Michael Pu, Bogdan Vasilescu, Meiyappan Nagappan2026-06-29
💻 computer science

Implementing GenAI-Supported Learning in Software Engineering and Computer Science Education using Bloom's Taxonomy

यह अध्ययन प्रदर्शित करता है कि सॉफ्टवेयर इंजीनियरिंग और कंप्यूटर साइंस के पाठ्यक्रमों में ब्लूम्स टैक्सोनॉमी-संरेखित ढांचे को समाहित करना, विभिन्न संज्ञानात्मक स्तरों के बीच उपयुक्त भूमिकाओं को स्पष्ट करके, छात्रों को जिम्मेदार और चिंतनशील जनरेटिव एआई उपयोग की ओर प्रभावी ढंग से निर्देशित करता है, जिससे शैक्षणिक ध्यान प्रवर्तन से हटकर इरादतन शिक्षण सहायता की ओर स्थानांतरित हो जाता है।

Vahid Garousi, Zafar Jafarov, Aytan Mövsümova, Leyla Memmedova, Hüseyn Mirzayev2026-06-29
💻 computer science

Formal Grammars in Business Process Management: A Systematic Literature Review

यह शोध पत्र 34 अध्ययनों की एक व्यवस्थित साहित्य समीक्षा प्रस्तुत करता है जो औपचारिक व्याकरण (formal grammars) और बिजनेस प्रोसेस मैनेजमेंट (BPM) के संगम पर सात विशिष्ट अनुसंधान धाराओं की पहचान करता है, जो BPM जीवनचक्र में उनके व्यापक प्रभाव को रेखांकित करते हुए क्रॉस-स्ट्रीम संश्लेषण की कमी को नोट करता है और व्याकरणिक सिद्धांत के एकीकृत दोहन के लिए भविष्य की दिशाओं का प्रस्ताव करता है।

Milliam Maxime Zekeng Ndadji2026-06-29
💻 computer science

LLM-Assisted Model-Based GUI Testing for Vue.js Web Applications

यह शोध पत्र LLMVue प्रस्तुत करता है, जो एक नवीन फ्रेमवर्क है जो बड़े भाषा मॉडलों (large language models) का लाभ उठाकर Vue.js सोर्स कोड को स्वचालित रूप से निष्पादन योग्य पेज ट्रांज़िशन ग्राफ़ में निकालता और एकीकृत करता है, जिससे रैंडम एक्सप्लोरेशन की तुलना में मॉडल-आधारित GUI टेस्टिंग के कवरेज और दक्षता को महत्वपूर्ण रूप से बढ़ाया जा सकता है।

Tao Li, Chenhui Cui, Rubing Huang, Dave Towey, Shikai Guo, Lei Ma2026-06-29