💻 computer science

UCSC-NLP at SemEval-2026 Task 13: Multi-View Generalization and Diagnostic Analysis of Machine-Generated Code Detection

UCSC-NLP टीम UniXcoder-base के मल्टी-व्यू फाइन-ट्यूनिंग फ्रेमवर्क के माध्यम से मशीन-जेनरेटेड कोड का मजबूत बाइनरी डिटेक्शन प्राप्त करके और यह प्रदर्शित करके कि गंभीर डेटा असंतुलन के कारण मल्टी-क्लास एट्रिब्यूशन में होने वाली कैटास्ट्रोफिक विफलता (catastrophic failure) को दूर करने के लिए क्लास-वेटेड ट्रेनिंग आवश्यक है, SemEval-2026 टास्क 13 को संबोधित करती है।

Kargi Chauhan, Sadiba Nusrat Nur2026-05-01
💻 computer science

Adaptive and AI-Augmented Security Testing: A Systematic Survey of Program Analysis, Feedback-Driven Testing, and Hybrid Learning-Based Approaches

यह शोध पत्र एडेप्टिव और एआई-ऑगमेंटेड सुरक्षा परीक्षण पर 55 अध्ययनों का एक व्यवस्थित सर्वेक्षण प्रस्तुत करता है, जो संरचनात्मक प्रोग्राम विश्लेषण और एडेप्टिव लर्निंग मैकेनिज्म के बीच एक महत्वपूर्ण विच्छेद की पहचान करता है और इस अंतर को पाटने के लिए सिमेंटिकली ग्राउंडेड, फीडबैक-ड्रिवन फ्रेमवर्क के माध्यम से एक एकीकृत अनुसंधान एजेंडा प्रस्तावित करता है।

Michael Wienczkowski2026-05-01
💻 computer science

LLM-Guided Runtime Parameter Optimization for Energy-Efficient Model Inference

यह शोध पत्र एक ह्यूमन-इन-द-लूप फ्रेमवर्क प्रस्तावित करता है जो ऊर्जा-कुशल मॉडल इन्फरेंस के लिए रनटाइम मापदंडों को तेजी से और कुशलता से अनुकूलित करने के लिए विशिष्ट फीडबैक प्रॉम्प्टिंग के साथ एलएलएम (LLMs) का लाभ उठाता है, जो अभिसरण गति (convergence speed) और अंतिम ऊर्जा खपत दोनों में सोबोल सैंपलिंग (Sobol sampling) जैसे पारंपरिक खोज तरीकों से बेहतर प्रदर्शन करता है।

Katelyn Crumpacker, Dimitrios Nikolopoulos2026-05-01
💻 computer science

Where did we fail? -- Reproducing build failures in embedded open source software

यह शोधपत्र PhantomRun को प्रस्तुत करता है, जो एक एकीकृत एब्स्ट्रैक्शन लेयर और डेटासेट है जो एम्बेडेड ओपन सोर्स सॉफ्टवेयर के लिए CI बिल्ड लॉग्स और मेटाडेटा की पुनर्प्राप्ति और निष्ठापूर्ण पुनरुत्पादन को मानकीकृत करता है, जिससे उच्च पुनर्निर्माण सटीकता के साथ ऐतिहासिक बिल्ड विफलताओं के बड़े पैमाने पर, पुनरुत्पादनीय अध्ययन सक्षम होते हैं।

Han Fu, Andreas Ermedahl, Sigrid Eldh, Kristian Wiklund, Philipp Haller, Cyrille Artho2026-05-01
🤖 AI

When Your LLM Reaches End-of-Life: A Framework for Confident Model Migration in Production Systems

यह शोध पत्र एक बेयसियन सांख्यिकीय ढांचे (Bayesian statistical framework) को प्रस्तुत करता है जो मानव निर्णयों के विरुद्ध स्वचालित मेट्रिक्स को कैलिब्रेट करता है ताकि जब अंतर्निहित मॉडल अपनी जीवन-अवधि (end-of-life) तक पहुँच जाएँ, तब लाखों उपयोगकर्ताओं को सेवा देने वाले एक वाणिज्यिक प्रश्न-उत्तर मंच पर प्रदर्शित किए अनुसार, उत्पादन-स्तर के LLM-आधारित सिस्टमों का आत्मविश्वासपूर्ण, कुशल और पुनरुत्पादनीय माइग्रेशन सक्षम किया जा सके।

Emma Casey, David Roberts, David Sim, Ian Beaver2026-05-01
💻 computer science

On the Effectiveness of Modular Testing with EvoSuite

यह शोध पत्र \textsc{emote} को प्रस्तुत करता है, जो EvoSuite टेस्ट जनरेटर का एक संवर्धन है जो गैर-लक्ष्य सेटअप कॉल्स पर प्रतिबंधों को शिथिल करके और फिटनेस फ़ंक्शन को परिष्कृत करके जावा प्रोग्रामों के लिए मॉड्यूलर टेस्टिंग प्रभावशीलता में सुधार करता है, जिसके परिणामस्वरूप लक्ष्य विधियों (target methods) के लिए ब्रांच कवरेज में 15.15% की वृद्धि होती है।

Elizabeth Dinella2026-05-01
💻 computer science

CI-Repair-Bench: A Repository-Aware Benchmark for Automated Patch Validation via CI Workflows

यह शोध पत्र CI-Repair-Bench प्रस्तुत करता है, जो वास्तविक GitHub Actions निष्पादमनों (executions) से निर्मित एक रिपॉजिटरी-जागरूक बेंचमार्क है जो विशेष रूप से पूर्ण CI पुन: निष्पादन (re-execution) के माध्यम से स्वचालित प्रोग्राम मरम्मत का मूल्यांकन करता है, जिससे यह पता चलता है कि जहाँ LLM प्रभावी ढंग से स्थानीयकृत टूल-प्रवर्तित विफलताओं को संभालते हैं, वहीं वे जटिल वातावरण और निर्भरता संबंधी समस्याओं के साथ संघर्ष करते हैं।

Rabeya Khatun Muna (Peter), Md Nakhla Rafi (Peter), Tse-Hsun (Peter), Chen2026-05-01
💻 computer science

Theory Under Construction: Orchestrating Language Models for Research Software Where the Specification Evolves

यह शोध पत्र Comet-H प्रस्तुत करता है, जो एक इटरेटिव प्रॉम्प्ट ऑटोमेटन (iterative prompt automaton) है जो अनुसंधान सॉफ्टवेयर में मतिभ्रम (hallucination) और असंतुलन (desynchronization) को रोकने के लिए कोड, सिद्धांत और दस्तावेज़ीकरण के युग्मित विकास को व्यवस्थित करता है, और एक पायथन स्टैटिक-एनालिसिस टूल के माध्यम से अपनी प्रभावशीलता प्रदर्शित करता है जो 90-मामलों के बेंचमार्क पर बेसलाइन से काफी बेहतर प्रदर्शन करता है।

Halley Young, Nikolaj Björner2026-05-01
💻 computer science

Now's the Time: Computer Science Must Evolve to Emphasize Software and Systems Engineering with Artificial Intelligence (AI)

यह शोधपत्र तर्क देता है कि कंप्यूटर विज्ञान शिक्षा को प्रोग्रामिंग और एल्गोरिदम को अपने आप में साध्य मानने के बजाय तुरंत एक सिस्टम- और इंजीनियरिंग-केंद्रित पाठ्यक्रम में विकसित होना चाहिए, जो स्नातकों को केवल नियमित कोडिंग कार्यों में एआई (AI) के साथ प्रतिस्पर्धा करने के बजाय जटिल एआई-सक्षम प्रणालियों को डिजाइन करने, सत्यापित करने और ऑर्केस्ट्रेट करने के लिए तैयार करे।

Chandra N. Sekharan, George K. Thiruvathukal2026-05-01
🤖 AI

Self-Evolving Software Agents

यह शोध पत्र एक स्व-विकसित (self-evolving) सॉफ्टवेयर एजेंट आर्किटेक्चर प्रस्तुत करता है जो गतिशील मल्टी-एजेंट परिवेशों में अनुभव के आधार पर लक्ष्यों, तर्क और निष्पादन योग्य कोड को स्वायत्त रूप से अपडेट करने के लिए BDI रीजनिंग को लार्ज लैंग्वेज मॉडल्स (LLMs) के साथ एकीकृत करता है, जो LLM-संचालित सॉफ्टवेयर विकास की व्यवहार्यता और वर्तमान सीमाओं दोनों को प्रदर्शित करता है।

Marco Robol, Paolo Giorgini2026-05-01