💬 NLP

LLMSniffer: Detecting LLM-Generated Code via GraphCodeBERT and Supervised Contrastive Learning

यह शोध पत्र LLMSniffer को पेश करता है, जो एक ऐसा डिटेक्शन फ्रेमवर्क है जो बेंचमार्क डेटासेट्स पर एआई-जनरेटेड कोड और मानव-लिखित कोड के बीच अंतर करने की सटीकता को महत्वपूर्ण रूप से सुधारने के लिए ग्राफकोडबर्ट (GraphCodeBERT) को सुपरवाइज्ड कॉन्ट्रास्टिव लर्निंग और कमेंट रिमूवल प्रीप्रोसेसिंग के साथ जोड़ता है।

Mahir Labib Dihan, Abir Muhtasim2026-04-20
💻 computer science

From Papers to Progress: Rethinking Knowledge Accumulation in Software Engineering

280 शोधकर्ताओं के दृष्टिकोणों के विश्लेषण के आधार पर, यह शोध पत्र सॉफ्टवेयर इंजीनियरिंग में ज्ञान संचय के लिए संरचनात्मक बाधाओं—जैसे कि अलग-थलग पड़े शोध पत्र और गलत संरेखित प्रोत्साहन—की पहचान करता है और संचयी वैज्ञानिक प्रगति को बढ़ावा देने के लिए अनुसंधान कलाकृतियों (research artifacts) को पुनर्गठित करने हेतु चार तकनीक-तटस्थ सिद्धांतों का प्रस्ताव करता है।

Jason Cusati, Chris Brown2026-04-20
💻 computer science

Investigating Conversational Agents to Support Secondary School Students Learning CSP

यह शोध पत्र एपी कंप्यूटर साइंस प्रिंसिपल्स सीख रहे 45 माध्यमिक विद्यालय के छात्रों की सहायता करने में सामान्य-उद्देश्य वाले जनरेटिव और कस्टम फिक्स्ड-रिस्पॉन्स संवादात्मक एजेंटों की प्रभावशीलता और जुड़ाव का मूल्यांकन करता है, जो उपयुक्त शिक्षण संसाधन खोजने की चुनौतियों को दूर करने की उनकी क्षमता को रेखांकित करता है।

Matthew Frazier, Kostadin Damevski, Lori Pollock2026-04-20
🛠️ software engineering

AIRA: AI-Induced Risk Audit: A Structured Inspection Framework for AI-Generated Code

यह शोध पत्र AIRA को प्रस्तुत करता है, जो 'फेलियर ट्रुथफुलनेस' (Failure Truthfulness)—अर्थात कोड के बाहरी रूप से दृश्यमान संकेतों और उसके वास्तविक आंतरिक निष्पादन अवस्था के बीच संरेखण—को मापने के लिए एक संरचित 15-चेक निरीक्षण ढांचा है, और तीन अनुभवजन्य अध्ययनों को प्रस्तुत करता जिनके निष्कर्ष 'रिवॉर्ड-शेप्ड फेलियर हाइपोथीसिस' (Reward-Shaped Failure Hypothesis) के अनुरूप हैं: कि सफल दिखने वाले आउटपुट के पक्ष में प्रशिक्षण-समय रिवॉर्ड दबाव अनजाने में एआई-जनित कोड को मानव-लिखित नियंत्रणों की तुलना में कम विफलता संकेत प्रदर्शित करने के लिए आकार दे सकता है।

William M. Parris2026-04-19
💻 computer science

An Empirical Study of API Misuses of Data-Centric Libraries

यह शोध पत्र पाँच डेटा-केंद्रित लाइब्रेरीज़ में API के दुरुपयोग का एक अनुभवजन्य अध्ययन प्रस्तुत करता है, जो यह प्रकट करता है कि उनकी अनूठी विशेषताएँ और दस्तावेज़ीकरण के बावजूद व्यापक प्रसार, डीप लर्निंग लाइब्रेरीज़ में देखे गए पैटर्न के अनुरूप हैं, जिससे बेहतर पहचान उपकरणों की आवश्यकता पर बल मिलता है और इन समस्याओं को कम करने के लिए भविष्य के अनुसंधान की नींव रखी जाती है।

Akalanka Galappaththi, Sarah Nadi, Christoph Treude2026-04-17
💻 computer science

Research Artifacts in Secondary Studies: A Systematic Mapping in Software Engineering

537 सॉफ्टवेयर इंजीनियरिंग माध्यमिक अध्ययनों का यह व्यवस्थित मानचित्रण यह प्रकट करता है कि जबकि पिछले दशक में अनुसंधान आर्टिफ़ैक्ट्स (research artifacts) की रिपोर्टिंग में महत्वपूर्ण सुधार हुआ है, फिर भी अधिकांश में उनकी कमी या स्थायी भंडारण का अभाव है, जो पारदर्शिता और पुनरुत्पादकता (reproducibility) को बढ़ाने के लिए अनिवार्य प्रकाशन का आह्वान करता है।

Aleksi Huotala, Miikka Kuutila, Mika Mäntylä2026-04-17
💻 computer science

Mutation-Guided Unit Test Generation with a Large Language Model

यह शोध पत्र MUTGEN को प्रस्तुत करता है, जो एक म्यूटेशन-गाइडेड लार्ज लैंग्वेज मॉडल दृष्टिकोण है जो प्रॉम्प्ट्स में म्यूटेशन फीडबैक को शामिल करता है और एक पुनरावृत्ति जनरेशन तंत्र का उपयोग करता है ताकि पारंपरिक कोड कवरेज के बजाय म्यूटेशन स्कोर द्वारा मापे गए उच्च दोष-पता लगाने की क्षमताओं वाले यूनिट टेस्ट उत्पन्न करने में EvoSuite जैसे मौजूदा उपकरणों से काफी बेहतर प्रदर्शन किया जा सके।

Guancheng Wang, Qinghua Xu, Lionel Briand, Kui Liu2026-04-17
💻 computer science

Managing Power Gaps as an Element of Pair Programming Skill: A Grounded Theory

यह शोध पत्र यह प्रदर्शित करने के लिए ग्राउंडेड थ्योरी का उपयोग करता है कि ज्ञान की असमानताओं और पदानुक्रमित व्यवहार से उत्पन्न होने वाले "पावर गैप्स" (शक्ति अंतराल) के कारण उच्च आपसी समझ के बावजूद पेयर प्रोग्रामिंग सत्र विफल हो सकते हैं, और यह प्रस्ताव देता है कि अभ्यावसी इन अंतरालों को पहचानकर और "इक्वलाइजिंग बिहेवियर" (समान बनाने वाले व्यवहार) को लागू करके परिणामों में सुधार कर सकते हैं।

Linus Ververs, Janina Berger, Lutz Prechelt2026-04-17
🤖 AI

AISysRev -- LLM-based Tool for Title-abstract Screening

यह शोध पत्र AISysRev को प्रस्तुत करता है, जो एक कंटेनराइज्ड वेब टूल है जो व्यवस्थित समीक्षाओं (systematic reviews) के शीर्षक-सार स्क्रीनिंग चरण को गति देने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जो प्रति मिनट सैकड़ों शोध पत्रों को संसाधित करते हुए परिणामों को वर्गीकृत करता है ताकि उन मामलों को उजागर किया जा सके जिनमें मानवीय हस्तक्षेप की आवश्यकता होती है।

Aleksi Huotala, Miikka Kuutila, Olli-Pekka Turtio, Simo Sipilä, Mika Mäntylä2026-04-17
💬 NLP

Chinese Language Is Not More Efficient Than English in Vibe Coding: A Preliminary Study on Token Cost and Problem-Solving Rate

यह प्रारंभिक अध्ययन इस दावे का खंडन करता है कि LLM कोडिंग कार्यों के लिए चीनी प्रॉम्प्ट अंग्रेजी की तुलना में अधिक टोकन-कुशल होते हैं, बल्कि यह दर्शाता है कि चीनी प्रॉम्प्ट अक्सर कम सफलता दर और मॉडल-निर्भर टोकन लागत का परिणाम देते हैं जो अपेक्षित बचत प्रदान नहीं करते हैं।

Simiao Ren (Tsang), Xingyu Shen (Tsang), Yuchen Zhou (Tsang), Dennis (Tsang), Ng, Ankit Raj2026-04-17