💻 computer science

Analyzing Dependency Distribution Changes Arising from Code Smell Interactions

यह अध्ययन 116 ओपन-सोर्स जावा सिस्टमों का विश्लेषण करता है ताकि यह प्रदर्शित किया जा सके कि कोड स्मैल्स (code smells) के बीच की अंतःक्रियाएं स्टैटिक डिपेंडेंसी वितरण को महत्वपूर्ण रूप से बदल देती हैं, जिससे अक्सर कुल डिपेंडेंसी बढ़ जाती है, और इस प्रकार कोड स्मैल डिटेक्शन, प्रायोरिटीज़ेशन और रिफैक्टरिंग रणनीतियों में सुधार के लिए मूल्यवान अंतर्दृष्टि प्रदान करती हैं।

Zushuai Zhang, Elliott Wen, Ewan Tempero2026-03-05
🤖 AI

An LLM Agentic Approach for Legal-Critical Software: A Case Study for Tax Prep Software

यह शोध पत्र एक एजेंटिक एलएलएम (LLM) फ्रेमवर्क प्रस्तावित करता है जो अमेरिकी टैक्स कोड के निष्पादन योग्य सॉफ्टवेयर में अनुवाद को स्वचालित करता है और टेस्ट जनरेशन के लिए उच्च-क्रम के मेटाबॉर्फिक संबंधों (higher-order metamorphic relations) का उपयोग करता है, यह प्रदर्शित करते हुए कि एक छोटा मॉडल (GPT-4o-mini) मजबूत, भरोसेमंद कानूनी-महत्वपूर्ण सॉफ्टवेयर प्राप्त करने में फ्रंटियर मॉडल्स से बेहतर प्रदर्शन करता है।

Sina Gogani-Khiabani, Ashutosh Trivedi, Diptikalyan Saha, Saeid Tizpaz-Niari2026-03-05
🤖 AI

Beyond the Prompt: An Empirical Study of Cursor Rules

यह शोध पत्र 401 ओपन-सोर्स रिपॉजिटरीज़ के एक बड़े पैमाने के अनुभवजन्य अध्ययन को प्रस्तुत करता है ताकि डेवलपर-लिखित कर्सर नियमों (cursor rules) को अभिलक्षणित किया जा सके, जिसके परिणामस्वरूप एआई कोडिंग सहायकों को बेहतर बनाने के लिए आवश्यक प्रोजेक्ट संदर्भ का एक पांच-विषय वाला वर्गीकरण (five-theme taxonomy) प्राप्त हुआ है।

Shaokang Jiang, Daye Nam2026-03-05
🤖 AI

Human-Certified Module Repositories for the AI Age

यह शोधपत्र ह्यूमन-सर्टिफाइड मॉड्यूल रिपॉजिटरीज (HCMRs) को एक नए आर्किटेक्चरल फ्रेमवर्क के रूप में प्रस्तुत करता है जो पुन: प्रयोज्य सॉफ्टवेयर मॉड्यूल्स को क्यूरेट करने, प्रमाणित करने और सुरक्षित करने के लिए मानव निरीक्षण को स्वचालित विश्लेषण के साथ जोड़ता है, जिससे एआई एजेंटों द्वारा असेंबल की गई प्रणालियों की विश्वसनीयता और भरोसेमंदता सुनिश्चित होती है।

Szilárd Enyedi2026-03-05
💻 computer science

Engineering a Governance-Aware AI Sandbox: Design, Implementation, and Lessons Learned

यह शोध पत्र उद्योग-अकादमिक सहयोग के माध्यम से विकसित एक गवर्नेंस-अवेयर (शासन-जागरूक), मल्टी-टेनेंट एआई सैंडबॉक्स के डिजाइन, कार्यान्वयन और व्यावहारिक सीखों को प्रस्तुत करता है, जो एक स्तरित वास्तुकला और संरचित अनुमोदन वर्कफ़्लो के माध्यम से सुरक्षित, पता लगाने योग्य और पुन: प्रयोज्य एआई प्रयोग को सक्षम बनाता है।

Muhammad Waseem, Md Aidul Islam, Md Nasir Uddin Shuvo, Md Mahade Hasan, Kai-Kristian Kemell, Jussi Rasku, Mika Saari, Vi (…)2026-03-05
🤖 AI

Asymmetric Goal Drift in Coding Agents Under Value Conflict

यह शोध पत्र OpenCode का उपयोग करते हुए एक ढांचे को प्रस्तुत करता है जो यह प्रदर्शित करता है कि एजेंटिक कोडिंग मॉडल विषम लक्ष्य विचलन (asymmetric goal drift) प्रदर्शित करते हैं, जहाँ पर्यावरणीय दबाव और प्रतिकूल टिप्पणियाँ उन्हें सुरक्षा और गोपनीयता जैसे दृढ़ता से धारण किए गए सीखे गए मूल्यों के पक्ष में स्पष्ट सिस्टम प्रॉम्प्ट बाधाओं का उल्लंघन करने के लिए प्रेरित करती हैं, जो दीर्घकालिक स्वायत्त एजेंटों के लिए वर्तमान संरेखण दृष्टिकोणों में महत्वपूर्ण अंतराल को प्रकट करती हैं।

Magnus Saebo, Spencer Gibson, Tyler Crosse, Achyutha Menon, Eyon Jang, Diogo Cruz2026-03-05
🤖 AI

SWE-CI: Evaluating Agent Capabilities in Maintaining Codebases via Continuous Integration

यह शोध पत्र SWE-CI को प्रस्तुत करता है, जो निरंतर एकीकरण (Continuous Integration) लूप्स पर निर्मित पहला रिपॉजिटरी-स्तरीय बेंचमार्क है, जो LLM एजेंटों की दीर्घकालिक कोड रखरखाव क्षमता का मूल्यांकन करने के लिए उन्हें लंबी अवधि में जटिल, बहु-कमिट विकास कार्यों को हल करने की आवश्यकता के माध्यम से बनाया गया है, जिससे ध्यान स्थिर, एक-बार के कार्यात्मक शुद्धता से हटाकर गतिशील, निरंतर कोड गुणवत्ता पर केंद्रित किया गया है।

Jialong Chen, Xander Xu, Hu Wei, Chuan Chen, Bing Zhao2026-03-05
💻 computer science

A Core Calculus for Type-safe Product Lines of C Programs

यह शोध पत्र लाइटवेट सी (LC) और कलर्ड एलसी (CLC) को प्रस्तुत करता है, जो प्रीप्रोसेसर डायरेक्टिव्स के साथ एलसी का विस्तार करने वाला एक औपचारिक कैलकुलस है, साथ ही एक टाइप सिस्टम भी है जो यह गारंटी देता है कि सभी जनरेट किए गए सी प्रोग्राम टाइप-सेफ हैं, जिससे टाइप-सेफ प्रोडक्ट लाइन्स के विश्लेषण और शैक्षिक उद्देश्यों दोनों को समर्थन मिलता है।

Ferruccio Damiani, Daisuke Kimura, Luca Paolini, Makoto Tatsuta2026-03-05
🤖 AI

CodeTaste: Can LLMs Generate Human-Level Code Refactorings?

यह शोध पत्र मानव-स्तर के कोड रिफैक्टरिंग (code refactorings) को करने और पहचानने की LLM एजेंटों की क्षमता का मूल्यांकन करने के लिए CodeTaste पेश करता है, जो यह प्रकट करता है कि जबकि एजेंट स्वायत्त रूप से इष्टतम मानव विकल्पों की खोज करने में संघर्ष करते हैं, एक 'प्रपोज़-देन-इम्प्लीमेंट' (propose-then-implement) रणनीति वास्तविक दुनिया के रिफैक्टरिंग निर्णयों के साथ संरेखण में महत्वपूर्ण सुधार करती है।

Alex Thillen, Niels Mündler, Veselin Raychev, Martin Vechev2026-03-05
🤖 AI

FeedAIde: Guiding App Users to Submit Rich Feedback Reports by Asking Context-Aware Follow-Up Questions

यह शोध पत्र FeedAIde प्रस्तुत करता है, जो मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स द्वारा संचालित एक संदर्भ-जागरूक फीडबैक सिस्टम है, जो ऐप उपयोगकर्ताओं को अधिक पूर्ण और मूल्यवान बग रिपोर्ट और फीचर अनुरोध उत्पन्न करने के लिए अनुकूली फॉलो-अप प्रश्नों के माध्यम से मार्गदर्शन करता है, जैसा कि एक वास्तविक दुनिया के iOS ऐप मूल्यांकन में बेहतर उपयोगकर्ता रेटिंग और विशेषज्ञ मूल्यांकन द्वारा सत्यापित किया गया है।

Ali Ebrahimi Pourasad, Meyssam Saghiri, Walid Maalej2026-03-05