🤖 AI

Formal Architecture Descriptors as Navigation Primitives for AI Coding Agents

यह शोध पत्र यह प्रदर्शित करता है कि AI कोडिंग एजेंटों को औपचारिक आर्किटेक्चर डिस्क्रिप्टर, विशेष रूप से प्रस्तावित S-expression फॉर्मेट "intent.lisp" प्रदान करने से, अंधेरे में अन्वेषण (blind exploration) की तुलना में नेविगेशनल ओवरहेड और व्यवहार संबंधी भिन्नता में काफी कमी आती है और कार्य सटीकता में सुधार होता है।

Ruoqi Jin2026-04-16
🤖 AI

The Code Whisperer: LLM and Graph-Based AI for Smell and Vulnerability Resolution

यह शोध पत्र "द कोड व्हिस्परर" (The Code Whisperer) को प्रस्तुत करता है, जो एक हाइब्रिड फ्रेमवर्क है जो कोड स्मेल्स और कमजोरियों (vulnerabilities) का संयुक्त रूप से पता लगाने, समझाने और सुधारने के लिए ग्राफ-आधारित प्रोग्राम विश्लेषण को लार्ज लैंग्वेज मॉडल्स के साथ एकीकृत करता है, जो मौजूदा नियम-आधारित या एकल-मॉडल दृष्टिकोणों की तुलना में बेहतर प्रदर्शन और व्यावहारिक उपयोगिता प्रदर्शित करता है।

Mohammad Baqar, Raji Rustamov, Alexander Hughes2026-04-16
🤖 AI

AgentForge: Execution-Grounded Multi-Agent LLM Framework for Autonomous Software Engineering

यह शोध पत्र AgentForge को प्रस्तुत करता है, जो एक ओपन-सोर्स मल्टी-एजेंट फ्रेमवर्क है जो एक अनिवार्य सैंडबॉक्स्ड वातावरण के माध्यम से निष्पादन-आधारित सत्यापन (execution-grounded verification) को लागू करता है, और मुख्य पर्यवेक्षण संकेत (supervision signal) के रूप में निष्पादन फीडबैक का लाभ उठाकर SWE-Bench Lite पर 40.0% रिज़ॉल्यूशन दर प्राप्त करता है और सिंगल-एजेंट बेसलाइन की तुलना में काफी बेहतर प्रदर्शन करता है।

Rajesh Kumar, Waqar Ali, Junaid Ahmed, Najma Imtiaz Ali, Shaban Usman2026-04-16
💻 computer science

How Developers Adopt, Use, and Evolve CI/CD Caching: An Empirical Study on GitHub Actions

यह शोध पत्र GitHub Actions पर CI/CD कैशिंग का पहला अनुभवजन्य अध्ययन प्रस्तुत करता है, जो 952 रिपॉजिटरीज़ का विश्लेषण करके यह प्रकट करता है कि कैश अपनाने वाले प्रोजेक्ट्स अधिक सक्रिय हैं, विविध और गैर-मानकीकृत तंत्रों का उपयोग करते हैं, और उन्हें मानव समस्या समाधान एवं स्वचालित निर्भरता अपडेट दोनों द्वारा संचालित महत्वपूर्ण निरंतर रखरखाव की आवश्यकता होती है।

Kazi Amit Hasan, Yuan Tian, Safwat Hassan, Steven H. H. Ding2026-04-16
💻 computer science

Comprehension Debt in GenAI-Assisted Software Engineering Projects

207 छात्रों का यह गुणात्मक अध्ययन यह प्रकट करता है कि जहाँ जेनरेटिव एआई (GenAI) उपकरण सॉफ्टवेयर इंजीनियरिंग परियोजनाओं में संज्ञानात्मक भार (cognitive load) को कम करते हैं, वहीं वे साथ ही साथ "बोध ऋण" (Comprehension Debt)—जो तकनीकी ऋण से भिन्न एक सामूहिक संज्ञानात्मक अंतराल है—को भी बढ़ावा दे सकते हैं, जो ब्लैक-बॉक्स कोड स्वीकृति और सत्यापन बाईपास जैसे पैटर्न के माध्यम से उत्पन्न होता है, जिससे यह सुनिश्चित करने के लिए नई शैक्षणिक रणनीतियों की आवश्यकता होती है कि छात्र एआई पर निष्क्रिय रूप से निर्भर रहने के बजाय अपनी समझ को सक्रिय रूप से सुदृढ़ करें।

Muhammad Ovais Ahmad2026-04-16
🤖 AI

Learning from Change: Predictive Models for Incident Prevention in a Regulated IT Environment

यह अध्ययन प्रदर्शित करता है कि एक व्याख्यात्मक लाइटजीबीएम (LightGBM) मॉडल, जिसे संगठनात्मक संदर्भ और SHAP-आधारित व्याख्यात्मकता के साथ उन्नत किया गया है, एक विनियमित बैंकिंग परिवेश के भीतर आईटी परिवर्तन-संबंधी घटनाओं की भविष्यवाणी करने में पारंपरिक नियम-आधारित विधियों से बेहतर प्रदर्शन करता है, जिससे ऑडिट और अनुपालन आवश्यकताओं को पूरा करते हुए सक्रिय जोखिम शमन सक्षम होता है।

Eileen Kapel, Jan Lennartz, Luis Cruz, Diomidis Spinellis, Arie van Deursen2026-04-16
💻 computer science

TORAI: Unsupervised Fine-grained RCA using Multi-Source Telemetry Data

TORAI एक नवीन अनसुपरवाइज्ड (unsupervised) रूट कॉज़ एनालिसिस दृष्टिकोण है जो मल्टी-सोर्स टेलीमेट्री डेटा का लाभ उठाकर सेवाओं को क्लस्टर करने और कॉज़ल रैंकिंग करने के माध्यम से माइक्रोसर्विस सिस्टम में सूक्ष्म-स्तरीय विफलताओं की प्रभावी ढंग से पहचान करता है, जिससे यह पूर्ण सर्विस कॉल ग्राफ पर निर्भर रहने वाले और ट्रेस की कमी वाले "ब्लाइंड स्पॉट" सेवाओं के साथ संघर्ष करने वाले मौजूदा तरीकों की सीमाओं को दूर करता है।

Luan Pham, Huong Ha, Xiuzhen Zhang, Hongyu Zhang2026-04-16
💻 computer science

Debugging Performance Issues in WebAssembly Runtimes via Mutation-based Inference

यह शोध पत्र WarpL प्रस्तुत करता है, जो एक नवीन म्यूटेशन-आधारित टूल है जो मूल और कार्यात्मक रूप से समान उत्परिवर्तित (mutated) प्रोग्रामों के बीच मशीन कोड की तुलना करके WebAssembly रनटाइम्स में प्रदर्शन संबंधी समस्याओं के मूल कारणों की पहचान करता है, और Wasmtime में छह पहले से अज्ञात बगों सहित 12 में से 10 वास्तविक दुनिया की समस्याओं का सफलतापूर्वक निदान करता है।

Ruiying Zeng, Shuyao Jiang, Wenxuan Zhao, Yangfan Zhou2026-04-16
💻 computer science

On the Effectiveness of Context Compression for Repository-Level Tasks: An Empirical Investigation

यह शोधपत्र पहला व्यवस्थित अनुभवजन्य अध्ययन प्रस्तुत करता है जो यह प्रदर्शित करता है कि संदर्भ संपीड़न (context compression), विशेष रूप से निरंतर लेटेंट वेक्टर विधियों (continuous latent vector methods) के माध्यम से, रिपॉजिटरी-स्तरीय कोड इंटेलिजेंस कार्यों में शोर और विलंबता को प्रभावी ढंग से कम करता है और पूर्ण-संदर्भ प्रसंस्करण (full-context processing) की तुलना में प्रदर्शन और दक्षता में महत्वपूर्ण सुधार करता है।

Jia Feng, Zhanyue Qin, Cuiyun Gao, Ruiqi Wang, Chaozheng Wang, Yingwei Ma, Xiaoyuan Xie2026-04-16
🤖 AI

Sentiment analysis for software engineering: How far can zero-shot learning (ZSL) go?

यह अध्ययन प्रदर्शित करता है कि ज़ीरो-शॉट लर्निंग तकनीकें, विशेष रूप से जब विशेषज्ञ-क्यूरेटेड लेबल को एम्बेडिंग-आधारित या जनरेटिव मॉडलों के साथ संयोजित किया जाता है, सॉफ्टवेयर इंजीनियरिंग सेंटीमेंट एनालिसिस में एनोटेटेड डेटासेट की कमी को प्रभावी ढंग से संबोधित कर सकती हैं, जिससे अत्याधुनिक फाइन-ट्यून्ड ट्रांसफार्मर मॉडलों के तुलनीय प्रदर्शन प्राप्त होता है।

Reem Alfayez, Manal Binkhonain2026-04-16