💻 computer science

Teaching Practically Relevant Research Problem Formulation in Software Engineering with Lean Research Inception

यह शोध पत्र एक केस स्टडी प्रस्तुत करता है जो यह प्रदर्शित करता है कि लीन रिसर्च इनसेप्शन (Lean Research Inception) सॉफ्टवेयर इंजीनियरिंग के छात्रों और संकाय सदस्यों को ऐसे शोध समस्याएँ तैयार करने में मदद करने के लिए एक प्रभावी दृष्टिकोण है जो उद्योग प्रथाओं के साथ बेहतर ढंग से संरेखित हैं, जैसा कि तर्क, स्पष्टता और समस्या संरचना में महत्वपूर्ण सुधारों से प्रमाणित होता है।

Anrafel Fernandes Pereira, Tatiane Ornelas, Allysson Allex Araujo, Marcos Kalinowski2026-03-23
🤖 AI

Agentic Harness for Real-World Compilers

यह शोध पत्र llvm-autofix प्रस्तुत करता है, जो पहला एजेंटिक हार्नेस (agentic harness) है जो विशेष उपकरणों और बेंचमार्क से सुसज्जित है ताकि जटिल LLVM कंपाइलर बग्स को पहचानने और उन्हें ठीक करने में LLM की क्षमताओं को महत्वपूर्ण रूप से बढ़ाया जा सके, जो सामान्य-उद्देश्य वाले मॉडलों में देखे गए पर्याप्त प्रदर्शन अंतर को संबोधित करता है।

Yingwei Zheng, Cong Li, Shaohua Li, Yuqun Zhang, Zhendong Su2026-03-23
💻 computer science

TRACE: Evaluating Execution Efficiency of LLM-Based Code Translation

यह शोधपत्र **TRACE** को प्रस्तुत करता है, जो LLM-अनुवादित कोड की निष्पादन दक्षता (execution efficiency) का मूल्यांकन करने के लिए डिज़ाइन किया गया पहला बेंचमार्क है, जो यह प्रकट करता है कि कार्यात्मक शुद्धता (functional correctness) दक्षता के लिए एक खराब प्रॉक्सी है और वर्तमान मॉडल अक्सर एल्गोरिद्मिक दोषों, भाषा के बेमेल होने और संसाधन कुप्रबंधन के कारण अक्षम कोड उत्पन्न करते हैं।

Zhihao Gong, Zeyu Sun, Dong Huang, Qingyuan Liang, Jie M. Zhang, Dan Hao2026-03-20
💻 computer science

QLCoder: A Query Synthesizer For Static Analysis of Security Vulnerabilities

QLCoder एक एजेंटिक फ्रेमवर्क है जो एक्ज़ीक्यूशन फीडबैक, लैंग्वेज सर्वर प्रोटोकॉल इंटीग्रेशन और RAG-आधारित रिट्रीवल से उन्नत एक LLM का लाभ उठाता है, जो CVE मेटाडेटा से वैध CodeQL क्वेरीज़ को स्वचालित रूप से सिंथेसाइज़ करता है, जिससे एक मानक एजेंट के 10% की तुलना में जावा प्रोजेक्ट्स में सुरक्षा कमजोरियों का पता लगाने में 53.4% सफलता दर प्राप्त होती है।

Claire Wang, Ziyang Li, Saikat Dutta, Mayur Naik2026-03-20
💻 computer science

ITKIT: Feasible CT Image Analysis based on SimpleITK and MMEngine

ITKIT एक सुलभ CT इमेज विश्लेषण फ्रेमवर्क है जो SimpleITK और MMEngine पर निर्मित है जो DICOM से 3D सेगमेंटेशन तक एक पूर्ण पाइपलाइन प्रदान करता है, जो सीमित कंप्यूटिंग संसाधनों वाले शुरुआती लोगों और लचीले मॉडल कॉन्फ़िगरेशन के माध्यम से उन्नत उपयोगकर्ताओं, दोनों की जरूरतों को पूरा करता है, जैसा कि 12 विशिष्ट प्रयोगों द्वारा प्रमाणित किया गया है।

Yiqin Zhang, Meiling Chen2026-03-20
💻 computer science

CodeT5-RNN: Reinforcing Contextual Embeddings for Enhanced Code Comprehension

यह शोध पत्र एक हाइब्रिड LLM-RNN फ्रेमवर्क प्रस्तावित करता है जो क्रम-संवेदनशील निर्भरताओं को बेहतर ढंग से कैप्चर करने के लिए अनुक्रमिक RNN आर्किटेक्चर के साथ LLM-जनित प्रासंगिक एम्बेडिंग्स को पुन: संसाधित करके कोड कॉम्प्रिहेन्शन (कोड बोध) को बढ़ाता है, जो डिफेक्ट डिटेक्शन और वास्तविक कोडिंग डेटासेट्स पर स्टैंडअलोन मॉडल्स की तुलना में सांख्यिकीय रूप से महत्वपूर्ण प्रदर्शन सुधार प्रदर्शित करता है।

Md Mostafizer Rahman, Ariful Islam Shiplu, Yutaka Watanobe, Md Faizul Ibne Amin, Syed Rameez Naqvi, Fang Liu2026-03-20
🤖 AI

TDAD: Test-Driven Agentic Development - Reducing Code Regressions in AI Coding Agents via Graph-Based Impact Analysis

यह शोध पत्र TDAD को प्रस्तुत करता है, जो एक ओपन-सोर्स टूल है जो ग्राफ-आधारित प्रभाव विश्लेषण (graph-based impact analysis) का लाभ उठाकर AI कोडिंग एजेंटों को लक्षित परीक्षण संदर्भ (targeted test context) प्रदान करता है, जो बेसलाइन दृष्टिकोणों और प्रक्रियात्मक TDD निर्देशों दोनों की तुलना में कोड रिग्रेशन को काफी कम करता है और समस्या-समाधान दरों में सुधार करता है।

Pepe Alonso, Sergio Yovine, Victor A. Braberman2026-03-20
💬 NLP

BenchBrowser -- Collecting Evidence for Evaluating Benchmark Validity

लौकिक ब्राउज़र (Laukik Browser) एक रिट्रीवल टूल है जिसे अभ्यासकर्ताओं को उनके उपयोग के मामलों से संबंधित विशिष्ट परीक्षण मदों को सामने लाकर बेंचमार्क वैधता का मूल्यांकन करने में मदद करने के लिए डिज़ाइन किया गया है, जिससे संकीर्ण सामग्री कवरेज और अस्थिर रैंकिंग जैसी समस्याओं का निदान किया जा सके ताकि इच्छित लक्ष्यों और वास्तविक बेंचमार्क मापों के बीच के अंतर को पाटा जा सके।

Harshita Diddee, Gregory Yauney, Swabha Swayamdipta, Daphne Ippolito2026-03-20
💻 computer science

Circumventing Platform Defenses at Scale: Automated Content Replication from YouTube to Blockchain-Based Decentralized Storage

यह शोध पत्र YouTube-Synch प्रस्तुत करता है, जो एक उत्पादन प्रणाली है जो 3.5 वर्षों के अनुदैर्ध्य अध्ययन के दौरान युग्मित प्लेटफॉर्म सुरक्षा (coupled platform defenses), API बाधाओं और परिचालन विफलताओं को दूर करने के लिए तीन वास्तुशिल्प पीढ़ियों के माध्यम से विकसित होकर, निर्माता-अधिकृत YouTube सामग्री के विकेंद्रीकृत स्टोरेज पर विश्वसनीय, बड़े पैमाने पर स्वचालित प्रतिकृति (automated replication) को प्राप्त करता है।

Zeeshan Akram2026-03-20
💻 computer science

Who Tests the Testers? Systematic Enumeration and Coverage Audit of LLM Agent Tool Call Safety

यह शोध पत्र SafeAudit प्रस्तुत करता है, जो एक मेटा-ऑडिट फ्रेमवर्क है जो टूल-कॉल वर्कफ़्लो को व्यवस्थित रूप से सूचीबद्ध करता है और नियम-प्रतिरोध (rule-resistance) को परिमाणित करता है ताकि मौजूदा LLM एजेंट सुरक्षा बेंचमार्क में महत्वपूर्ण पूर्णता अंतराल (completeness gaps) को उजागर किया जा सके, जिससे 20% से अधिक उन अवशिष्ट असुरक्षित व्यवहारों का पता चला है जिन्हें वर्तमान परीक्षण पकड़ने में विफल रहते हैं।

Xuan Chen, Lu Yan, Ruqi Zhang, Xiangyu Zhang2026-03-20