💻 computer science

Test Code Review in the Era of GitHub Actions: A Replication Study

यह प्रतिकृति अध्ययन (replication study) यह प्रकट करता है कि जहाँ गैरिट (Gerrit) की तुलना में गिटहब (GitHub) का पुल रिक्वेस्ट मॉडल टेस्ट और प्रोडक्शन कोड के बीच अधिक संतुलित चर्चा को बढ़ावा देता है, वहीं गिटहब एक्शन्स (GitHub Actions) के व्यापक प्रसार ने विरोधाभासी रूप से टेस्ट कोड समीक्षा में भारी गिरावट ला दी है, जिसमें टेस्ट फाइलों के लिए पोस्ट-अडॉप्शन (post-adoption) समीक्षा मेट्रिक्स अक्सर शून्य तक पहुँच जाते हैं।

Hui Sun, Yinan Wu, Wesley K. G. Assunção, Kathryn T. Stolee2026-03-18
💬 NLP

Evaluating Agentic Optimization on Large Codebases

यह शोधपत्र FormulaCode को प्रस्तुत करता है, जो एक बेंचमार्क है जिसमें विशेषज्ञ पैच और सामुदायिक वर्कलोड के साथ 957 वास्तविक दुनिया के प्रदर्शन संबंधी बाधाएं (bottlenecks) शामिल हैं, ताकि बड़े कोडबेस पर एलएलएम (LLM) एजेंटों की समग्र, बहु-उद्देश्यीय अनुकूलन क्षमताओं का मूल्यांकन किया जा सके, जो यह प्रकट करता है कि यह फ्रंटियर मॉडल्स के लिए अभी भी एक महत्वपूर्ण चुनौती बना हुआ है।

Atharva Sehgal, James Hou, Akanksha Sarkar, Ishaan Mantripragada, Swarat Chaudhuri, Jennifer J. Sun, Yisong Yue2026-03-18
💻 computer science

Safety Case Patterns for VLA-based driving systems: Insights from SimLingo

यह शोध पत्र RAISE का प्रस्ताव करता है, जो एक नवीन सुरक्षा केस डिज़ाइन दृष्टिकोण है जिसमें टेलर्ड पैटर्न और एक विस्तारित हज़ार्ड एनालिसिस एंड रिस्क असेसमेंट (HARA) फ्रेमवर्क शामिल है, ताकि उभरते विज़न-लैंग्वेज-एक्शन (VLA) आधारित ड्राइविंग सिस्टम की सुरक्षा को कड़ाई से सुनिश्चित किया जा सके, जैसा कि SimLingo पर एक केस स्टडी के माध्यम से प्रदर्शित किया गया है।

Gerhard Yu, Fuyuki Ishikawa, Oluwafemi Odu, Alvine Boaye Belle2026-03-18
💬 NLP

SWE-QA-Pro: A Representative Benchmark and Scalable Training Recipe for Repository-Level Code Understanding

यह शोध पत्र SWE-QA-Pro प्रस्तुत करता है, जो विविध, लॉन्ग-टेल डेटा और कठिनाई अंशांकन के माध्यम से LLM मेमोराइजेशन को रोकने के लिए डिज़ाइन किया गया रिपॉजिटरी-स्तरीय कोड समझ के लिए एक कठोर बेंचमार्क है, साथ ही एक स्केलेबल दो-चरणीय प्रशिक्षण रेसिपी (SFT और RLAIF) भी प्रदान करता है जो छोटे ओपन मॉडल्स को एजेंटिक कोडबेस एक्सप्लोरेशन में GPT-4o से आगे निकलने में सक्षम बनाता है।

Songcheng Cai, Zhiheng Lyu, Yuansheng Ni, Xiangchao Chen, Baichuan Zhou, Shenzhe Zhu, Yi Lu, Haozhe Wang, Chi Ruan, Benj (…)2026-03-18
💻 computer science

GitOps for Capture the Flag Platforms

यह शोध पत्र CTF Pilot को प्रस्तुत करता है, जो एक GitOps-आधारित ढांचा है जो कैप्चर द फ्लैग (Capture The Flag) प्रतियोगिताओं की तैनाती और प्रबंधन को स्वचालित करने के लिए वर्शन-नियंत्रित रिपॉजिटरी का लाभ उठाता है, जिससे वास्तविक दुनिया की घटनाओं के लिए मजबूत अलगाव सुनिश्चित करते हुए सहयोग, लागत दक्षता और मापनीयता को बढ़ाया जा सकता है।

Mikkel Bengtson Albrechtsen, Jacopo Mauro, Torben Worm2026-03-18
⚛️ high-energy experiments

Results of the analysis of a survey for young scientists on training quality in HEP instrumentation software and machine learning

यह रिपोर्ट ईसीएफए (ECFA) अर्ली-करियर रिसर्चर्स पैनल द्वारा किए गए एक सर्वेक्षण के परिणामों का विवरण देती है, जिसका उद्देश्य इंस्ट्रूमेंटेशन के लिए सॉफ्टवेयर और मशीन लर्निंग में प्रशिक्षण कार्यक्रमों की सुलभता और गुणवत्ता का आकलन करना है, ताकि प्रयोगात्मक भौतिकी में शुरुआती करियर वाले शोधकर्ताओं के लिए सुधार हेतु मार्गदर्शन किया जा सके।

Cecilia Borca (for the ECFA ECR Panel), Javier Jiménez Peña (for the ECFA ECR Panel), David Marckx (for the ECFA ECR Pan (…)2026-03-18
💻 computer science

TRACE: Evaluating Execution Efficiency of LLM-Based Code Translation

यह शोध पत्र **TRACE** को प्रस्तुत करता है, जो LLM-अनुवादित कोड की निष्पादन दक्षता (execution efficiency) का मूल्यांकन करने के लिए डिज़ाइन किया गया पहला बेंचमार्क है, जो यह प्रकट करता है कि कार्यात्मक शुद्धता (functional correctness) दक्षता के लिए एक अविश्वसनीय प्रॉक्सी है और वर्तमान मॉडल अक्सर एल्गोरिद्मिक दोषों, भाषा के बेमेल होने और संसाधन कुप्रबंधन के कारण अक्षम अनुवाद उत्पन्न करते हैं।

Zhihao Gong, Zeyu Sun, Dong Huang, Qingyuan Liang, Jie M. Zhang, Dan Hao2026-03-18
💻 computer science

Improving Code Comprehension through Cognitive-Load Aware Automated Refactoring for Novice Programmers

यह शोध पत्र CDDRefactorER का परिचय देता है, जो एक संज्ञानात्मक-भार (cognitive-load) के प्रति सचेत स्वचालित रिफैक्टरिंग टूल है, जो अनियंत्रित एआई दृष्टिकोणों की तुलना में कोड जटिलता को काफी कम करता है और नौसिखिए प्रोग्रामरों की समझ और संरचनात्मक पठनीयता में सुधार करता है।

Subarna Saha, Alif Al Hasan, Fariha Tanjim Shifat, Mia Mohammad Imran2026-03-18
💻 computer science

Optimization under uncertainty: understanding orders and testing programs with specifications

यह शोध पत्र यह प्रदर्शित करता है कि कैसे कार्यात्मक प्रोग्रामिंग (फंक्शनल प्रोग्रामिंग) दो विशिष्ट प्रकार की अनिश्चितताओं—मान (वैल्यू) और फन्क्टरियल (फंक्टरियल)—के तहत अनुकूलन विधियों को कठोरता से निर्दिष्ट और परीक्षण कर सकती है, जो बहु-उद्देश्यीय और संभाव्य परिवेशों में न्यूनीकरण (मिनिमाइजेशन) के सामान्यीकरण के लिए आवश्यक क्रम संबंधों का विश्लेषण करती है।

Patrik Jansson, Nicola Botta, Tim Richter2026-03-17
💻 computer science

C2|Q>: A Robust Framework for Bridging Classical and Quantum Software Development

यह शोध पत्र C2|Q> को प्रस्तुत करता है, जो एक हार्डवेयर-अज्ञेय (hardware-agnostic), ओपन-सोर्स फ्रेमवर्क है जो मॉड्यूलर एनकोडिंग, परिनियोजन (deployment) और डिकोडिंग प्रक्रियाओं के माध्यम से शास्त्रीय विशिष्टताओं (classical specifications) को क्वांटम-निष्पादन योग्य प्रोग्रामों में स्वचालित रूप से अनुवादित करके शास्त्रीय और क्वांटम सॉफ्टवेयर विकास के बीच सेतु बनाता है, जिससे डेवलपर्स के लिए प्रवेश बाधा कम होती है और साथ ही सिम्युलेटर और वर्तमान NISQ हार्डवेयर दोनों पर विश्वसनीय प्रदर्शन का प्रदर्शन होता है।

Boshuai Ye, Arif Ali Khan, Teemu Pihkakoski, Peng Liang, Muhammad Azeem Akbar, Matti Silveri, Lauri Malmi2026-03-17