💻 computer science

RepoGenesis: Benchmarking End-to-End Microservice Generation from Readme to Repository

RepoGenesis README से पूर्ण कोडबेस तक एंड-टू-एंड माइक्रोसर्विस रिपॉजिटरी जनरेशन के लिए पहला बहुभाषी बेंचमार्क पेश करता है, जो यह प्रकट करता है कि जबकि वर्तमान एजेंट और IDE उच्च API कवरेज और परिनियोजन सफलता प्राप्त करते हैं, वे अभी भी आर्किटेक्चरल सुसंगतता और क्रॉस-फाइल निरंतरता के लिए संघर्ष करते हैं, एक ऐसा अंतर जिसे इस डेटासेट पर मॉडलों को फाइन-ट्यून करके संबोधित किया जा सकता है।

Zhiyuan Peng, Xin Yin, Pu Zhao, Fangkai Yang, Lu Wang, Ran Jia, Xu Chen, Qingwei Lin, Saravan Rajmohan, Dongmei Zhang2026-04-16
💻 computer science

Context Matters: Evaluating Context Strategies for Automated ADR Generation Using LLMs

यह शोध पत्र यह प्रदर्शित करता है कि लार्ज लैंग्वेज मॉडल्स का उपयोग करके स्वचालित आर्किटेक्चर डिसीजन रिकॉर्ड (ADR) जनरेशन के लिए, हाल के ऐतिहासिक संदर्भ की एक छोटी विंडो (आमतौर पर 3-5 रिकॉर्ड्स) का रणनीतिक चयन करना, मॉडल स्केल या जटिल रिट्रीवल-आधारित रणनीतियों पर निर्भर रहने की तुलना में गुणवत्ता और दक्षता के बीच संतुलन बनाने के लिए अधिक प्रभावी है।

Aviral Gupta, Rudra Dhar, Daniel Feitosa, Karthik Vaidhyanathan2026-04-16
💻 computer science

LLM-Enabled Open-Source Systems in the Wild: An Empirical Study of Vulnerabilities in GitHub Security Advisories

295 गिटहब (GitHub) सुरक्षा सूचनाओं (Security Advisories) का यह अनुभवजन्य अध्ययन प्रकट करता है कि जबकि एलएलएम-एकीकृत (LLM-integrated) प्रणालियाँ मुख्य रूप से इंजेक्शन और डिसेरियलाइजेशन (deserialization) जैसी पारंपरिक कोड-स्तरीय कमजोरियों को प्रदर्शित करती हैं, वे आपूर्ति श्रृंखला के मुद्दों (supply chain issues) और अत्यधिक एजेंसी (excessive agency) जैसे विशिष्ट वास्तुशिल्प जोखिम भी प्रस्तुत करती हैं जो वर्तमान प्रकटीकरण ढांचों में कम प्रतिनिधित्व वाले हैं, जिसके लिए व्यापक सुरक्षा विश्लेषण हेतु एक संयुक्त CWE और OWASP परिप्रेक्ष्य की आवश्यकता है।

Fariha Tanjim Shifat, Hariswar Baburaj, Ce Zhou, Jaydeb Sarker, Mia Mohammad Imran2026-04-16
💻 computer science

Programming Language Co-Usage Patterns on Stack Overflow: Analysis of the Developer Ecosystem

यह शोध पत्र स्टैक ओवरफ्लो (Stack Overflow) डेटा का एक तीन-चरणीय अनुभवजन्य विश्लेषण प्रस्तुत करता है जो एफपी-ग्रोथ (FP-Growth), एलडीए (LDA) और लुवेन (Louvain) कम्युनिटी डिटेक्शन को एकीकृत करता है ताकि यह प्रकट किया जा सके कि डेवलपर्स प्रोग्रामिंग भाषाओं का सह-उपयोग कैसे करते हैं, जिससे घनिष्ठ युग्मन क्लस्टर (tight coupling clusters), विशिष्ट विशेषज्ञता प्रोफाइल, और वेब/एंटरप्राइज, एप्पल (Apple), और सिस्टम्स/साइंटिफिक समुदायों के बीच जावा (Java) को एक एकीकृत हब के रूप में केंद्र में रखते हुए एक मैक्रो-स्तरीय पारिस्थितिकी तंत्र संरचना की पहचान की जा सके।

Bachan Ghimire, Nitin Gupta2026-04-16
💻 computer science

PlanCompiler: A Deterministic Compilation Architecture for Structured Multi-Step LLM Pipelines

यह शोध पत्र PlanCompiler को प्रस्तुत करता है, जो एक नियत (deterministic) संकलन आर्किटेक्चर है जो एक टाइप किए गए नोड रजिस्ट्री और स्टैटिक वैलिडेशन के माध्यम से योजना (planning) को निष्पादन (execution) से अलग करता है ताकि निष्पादन योग्य पायथन कोड उत्पन्न किया जा सके, जिससे संरचित बहु-चरणीय LLM वर्कफ़्लो पर फ्री-फॉर्म कोड जनरेशन बेसलाइन की तुलना में काफी अधिक विश्वसनीयता, कम लागत और प्रतिस्पर्धी विलंबता (latency) प्राप्त होती है।

Pranav Harikumar2026-04-16
💻 computer science

Contract-Coding: Towards Repo-Level Generation via Structured Symbolic Paradigm

यह शोध पत्र कॉन्ट्रैक्ट-कोडिंग (Contract-Coding) प्रस्तुत करता है, जो एक संरचित प्रतीकात्मक प्रतिमान (structured symbolic paradigm) है जो रिपो-लेवल जनरेशन में कॉन्टेक्स्ट-फिडेलिटी ट्रेड-ऑफ्स को दूर करने के लिए ऑटोनॉमस सिम्बोलिक ग्राउंडिंग (Autonomous Symbolic Grounding) के माध्यम से अस्पष्ट उपयोगकर्ता इरादों और निष्पादन योग्य कोड के बीच एक सेतु बनाता है, जिससे ग्रीनफील्ड-5 (Greenfield-5) बेंचमार्क पर अत्याधुनिक एजेंटों की तुलना में काफी उच्च कार्यात्मक सफलता और संरचनात्मक अखंडता प्राप्त होती है।

Yi Lin, Lujin Zhao, Yijie Shi2026-04-16
💻 computer science

Building Trust in the Skies: A Knowledge-Grounded LLM-based Framework for Aviation Safety

यह शोध पत्र एक नवीन ढांचे का प्रस्ताव करता है जो भ्रम (hallucinations) को कम करने और सत्यापन योग्य, विश्वसनीय सुरक्षा अंतर्दृष्टि सुनिश्चित करने के लिए रिट्रीवल-ऑगमेंटेड जनरेशन (RAG) आर्किटेक्चर के माध्यम से लार्ज लैंग्वेज मॉडल्स को एक गतिशील रूप से अपडेट होने वाले नॉलेज ग्राफ के साथ एकीकृत करके विमानन सुरक्षा निर्णय लेने की प्रक्रिया को बढ़ाता है।

Anirudh Iyengar, Alisa Tiselska, Dumindu Samaraweera, Hong Liu2026-04-16
💻 computer science

CCCE: A Continuous Code Calibration Engine for Autonomous Enterprise Codebase Maintenance via Knowledge Graph Traversal and Adaptive Decision Gating

यह शोध पत्र कंटीन्यूअस कोड कैलिब्रेशन इंजन (CCCE) प्रस्तुत करता है, जो एक इवेंट-ड्रिवन, AI-एजेंटिक सिस्टम है जो डायनेमिक नॉलेज ग्राफ ट्रैवर्सल, एडेप्टिव रिस्क-बेस्ड डिसीजन गेटिंग और मल्टी-स्केल कंटीन्यूअस लर्निंग का लाभ उठाकर जटिल एंटरप्राइज कोडबेस को स्वायत्त रूप से बनाए रखता है ताकि क्रॉस-रिपॉजिटरी कैलिब्रेशन को समन्वित किया जा सके और रेमेडिएशन समय को महत्वपूर्ण रूप से कम किया जा सके।

Santhosh Kusuma Kumar Parimi2026-04-16
💻 computer science

Fairness in Multi-Agent Systems for Software Engineering: An SDLC-Oriented Rapid Review

यह त्वरित समीक्षा सॉफ्टवेयर इंजीनियरिंग के भीतर LLM-सक्षम मल्टी-एजेंट सिस्टम में निष्पक्षता पर 18 अध्ययनों का विश्लेषण करती है, जो मूल्यांकन, सामान्यीकरण और शासन में महत्वपूर्ण अंतरालों की पहचान करती है जो वर्तमान में सॉफ्टवेयर विकास जीवन चक्र में निष्पक्षता-सुनिश्चित उपकरणों की तैनाती में बाधा डाल रहे हैं।

Corey Yang-Smith, Ronnie de Souza Santos, Ahmad Abdellatif2026-04-16
🤖 AI

Can Coding Agents Be General Agents?

यह शोध पत्र इस बात की जांच करता है कि क्या कोडिंग एजेंट एक एंटरप्राइज रिसोर्स प्लानिंग (ERP) सिस्टम के भीतर व्यावहारिक कार्यों पर उनके प्रदर्शन का मूल्यांकन करके एंड-टू-एंड बिजनेस प्रोसेस ऑटोमेशन के लिए सामान्यीकरण कर सकते हैं, जिसमें यह पाया गया कि हालांकि वे सरल कार्यों को विश्वसनीय रूप से संभालते हैं, लेकिन डोमेन लॉजिक और कोड निष्पादन के बीच के अंतर को पाटने की कठिनाई के कारण उन्हें जटिल कार्यों में संघर्ष करना पड़ता है।

Maksim Ivanov, Abhijay Rana, Gokul Prabhakaran2026-04-16