🤖 AI

Speed at the Cost of Quality: How Cursor AI Increases Short-Term Velocity and Long-Term Complexity in Open-Source Projects

यह अध्ययन एक डिफरेंस-इन-डिफरेंसेस डिज़ाइन का उपयोग यह प्रदर्शित करने के लिए करता है कि जबकि कर्सर एआई (Cursor AI) असिस्टेंट को अपनाना ओपन-सोर्स प्रोजेक्ट्स में अल्पकालिक विकास वेग (development velocity) को महत्वपूर्ण रूप से बढ़ाता है, वहीं यह साथ ही कोड जटिलता और स्टैटिक एनालिसिस चेतावनियों में एक निरंतर वृद्धि भी प्रेरित करता है जो अंततः दीर्घकालिक वेग मंदी का कारण बनती है।

Hao He, Courtney Miller, Shyam Agarwal, Christian Kästner, Bogdan Vasilescu2026-01-27
🤖 AI

OLAF: Towards Robust LLM-Based Annotation Framework in Empirical Software Engineering

यह पोजीशन पेपर OLAF का प्रस्ताव करता है, जो एक वैचारिक ढांचा है जो एम्पेरिकल सॉफ्टवेयर इंजीनियरिंग में LLM-आधारित एनोटेशन को पारदर्शिता और पुनरुत्पादकता बढ़ाने के लिए विश्वसनीयता, कैलिब्रेशन और ड्रिफ्ट जैसे प्रमुख कंस्ट्रक्ट्स को परिभाषित करके एक कठोर मापन प्रक्रिया के रूप में मानता है।

Mia Mohammad Imran, Tarannum Shaila Zaman2026-01-27
🤖 AI

Analyzing Message-Code Inconsistency in AI Coding Agent-Authored Pull Requests

यह अध्ययन 23,247 एआई-जनित (AI-generated) पुल रिक्वेस्ट का विश्लेषण करता है यह प्रकट करने के लिए कि संदेश-कोड विसंगतियां, विशेष रूप से वे विवरण जो अनिर्धारित परिवर्तनों का दावा करते हैं, स्वीकृति दरों को काफी कम कर देती हैं और मर्ज होने के समय को बढ़ा देती हैं, जिससे एआई कोडिंग एजेंटों में विश्वास कम होता है और बेहतर सत्यापन तंत्र की आवश्यकता पर बल मिलता है।

Jingzhi Gong, Giovanni Pinna, Yixin Bian, Jie M. Zhang2026-01-27
💻 computer science

Data-driven Test Generation for Fuzzing AI Compiler

यह शोध पत्र OPERA प्रस्तुत करता है, जो एक एकीकृत डेटा-संचालित परीक्षण ढांचा है जो तीन विशिष्ट तकनीकों (OPERA, OATest, और HARMONY) के माध्यम से AI कंपाइलर में चरण-विशिष्ट चुनौतियों को व्यवस्थित रूप से संबोधित करता है, और चार व्यापक रूप से उपयोग किए जाने वाले कंपाइलरों में 266 पहले से अज्ञात बगों का सफलतापूर्वक पता लगाता है।

Qingchao Shen2026-01-27
🤖 AI

Prompt Driven Development with Claude Code: Building a Complete TUI Framework for the Ring Programming Language

यह अध्ययन अनुभवजन्य रूप से प्रदर्शित करता है कि आधुनिक लार्ज लैंग्वेज मॉडल्स, विशेष रूप से क्लॉड कोड ओपस 4.5 (Claude Code Opus 4.5), पूरी तरह से प्रॉम्प्ट-संचालित वर्कफ़्लो के माध्यम से, रिंग (Ring) प्रोग्रामिंग भाषा के लिए एक जटिल, 7,420-लाइन वाले प्रोडक्शन-ग्रेड टर्मिनल यूजर इंटरफेस फ्रेमवर्क के विकास को प्रभावी ढंग से संचालित कर सकते हैं, जो लगभग दस घंटों के सक्रिय कार्य में वास्तुशिल्प सुसंगतता और कार्यात्मक पूर्णता प्राप्त करता है।

Mahmoud Samir Fayed, Ahmed Samir Fayed2026-01-27
💻 computer science

RGFL: Reasoning Guided Fault Localization for Automated Program Repair Using Large Language Models

यह शोध पत्र RGFL प्रस्तुत करता है, जो लार्ज लैंग्वेज मॉडल-आधारित स्वचालित प्रोग्राम रिपेयर के लिए एक नवीन रीजनिंग-गाइडेड फॉल्ट लोकलाइजेशन दृष्टिकोण है, जो प्रोजेक्ट-लेवल कोडबेस पर फ़ाइल- और एलिमेंट-लेवल लोकलाइजेशन सटीकता में महत्वपूर्ण सुधार करने के लिए एक पदानुक्रमित रीजनिंग मॉड्यूल और एक दो-चरणीय रैंकिंग योजना का उपयोग करता है, जिससे एंड-टू-एंड रिपेयर सफलता दर बढ़ती है।

Melika Sepidband, Hamed Taherkhani, Hung Viet Pham, Hadi Hemmati2026-01-27
🤖 AI

TAM-Eval: Evaluating LLMs for Automated Unit Test Maintenance

यह शोध पत्र TAM-Eval प्रस्तुत करता है, जो एक व्यापक ढांचा और बेंचमार्क है जिसमें पायथन, जावा और गो (Go) में 1,539 वास्तविक दुनिया के परिदृश्य शामिल हैं, जो फ़ाइल स्तर पर यूनिट टेस्ट निर्माण, मरम्मत और अपडेट करने जैसे कार्यों को स्वचालित करने में वर्तमान LLMs की सीमित क्षमताओं का मूल्यांकन करता है।

Elena Bruches, Vadim Alperovich, Dari Baturova, Roman Derunets, Daniil Grebenkin, Georgy Mkrtchyan, Oleg Sedukhin, Mikha (…)2026-01-27
💻 computer science

An Audit of Machine Learning Experiments on Software Defect Prediction

यह शोध पत्र 2019 और 2023 के बीच प्रकाशित 101 सॉफ्टवेयर दोष भविष्यवाणी अध्ययनों का ऑडिट करता है, जो प्रयोगात्मक डिजाइन और रिपोर्टिंग में व्यापक विसंगतियों को प्रकट करता है जो पुनरुत्पादकता को गंभीर रूप से सीमित करती हैं और बेहतर अनुसंधान प्रथाओं की महत्वपूर्ण आवश्यकता को रेखांकित करती हैं।

Giuseppe Destefanis, Leila Yousefi, Martin Shepperd, Allan Tucker, Stephen Swift, Steve Counsell, Mahir Arzoky2026-01-27
💻 computer science

On the Abolition of the "ICSE Paper" and the Adoption of the "Registered Proposal" and the "Results Report"

सॉफ्टवेयर इंजीनियरिंग अनुसंधान में नवीनता-दुष्चक्र (novelty-vicious cycle) और प्रतिकृति संकट (replicability crisis) को संबोधित करने के लिए, यह शोध पत्र पारंपरिक ICSE पेपर प्रारूप को समाप्त कर इसके स्थान पर सहकर्मी-समीक्षित "पंजीकृत प्रस्तावों" (Registered Proposals) और उसके बाद के "परिणाम रिपोर्टों" (Results Reports) से युक्त एक द्वि-स्तरीय प्रणाली का प्रस्ताव करता है, जो कि समुदाय की सर्वेक्षण प्रतिक्रियाओं द्वारा समर्थित एक विघटनकारी सुधार है।

Fabio Massacci, Winnie Mbaka2026-01-27
💻 computer science

How are MLOps Frameworks Used in Open Source Projects? An Empirical Characterization

यह शोध पत्र गिटहब (GitHub) परियोजनाओं में उनके अपनाए जाने का विश्लेषण करके और वास्तविक एपीआई (API) उपयोग पैटर्न को सामुदायिक फीचर अनुरोधों के साथ सहसंबंधित करके आठ लोकप्रिय ओपन-सोर्स एमएलओप्स (MLOps) फ्रेमवर्क के उपयोग का अनुभवजन्य रूप से लक्षण वर्णन करता है, जो यह प्रकट करता है कि डेवलपर्स मुख्य कार्यक्षमता, एपीआई एक्सपोज़र और सीआई/सीडी (CI/CD) एकीकरण में सुधार की तलाश करते हुए इन उपकरणों का उपयोग 'आउट-ऑफ-द-बॉक्स' करने के बजाय मुख्य रूप से एपीआई के माध्यम से उन्हें अनुकूलित करते हैं।

Fiorella Zampetti, Federico Stocchetti, Federica Razzano, Damian Andrew Tamburri, Massimiliano Di Penta2026-01-27