💻 computer science

Validating Formal Specifications with LLM-generated Test Cases

यह शोध पत्र एक अनुभवजन्य मूल्यांकन प्रस्तुत करता है जो यह प्रदर्शित करता है कि अत्याधुनिक लार्ज लैंग्वेज मॉडल्स, विशेष रूप से GPT-5, Alloy औपचारिक विनिर्देशों (formal specifications) में संरचनात्मक बाधाओं को मान्य करने के लिए प्राकृतिक भाषा की आवश्यकताओं से सिंटैक्टिक रूप से सही और सिमेंटिक रूप से वैध टेस्ट केस उत्पन्न करने को प्रभावी ढंग से स्वचालित कर सकते हैं।

Alcino Cunha, Nuno Macedo2026-02-19
💻 computer science

Comment Traps: How Defective Commented-out Code Augment Defects in AI-Assisted Code Generation

यह अध्ययन प्रकट करता है कि प्रॉम्प्ट्स में दोषपूर्ण कमेंट किए गए कोड (commented-out code) के कारण एआई-जनरेटेड कोड में दोषों की दर 58.17% तक बढ़ जाती है, क्योंकि मॉडल केवल उन्हें कॉपी करने के बजाय इन त्रुटिपूर्ण पैटर्न को पूरा करने के लिए सक्रिय रूप से तर्क देते हैं, और ऐसे संदर्भ को अनदेखा करने के स्पष्ट निर्देश भी इस समस्या को काफी हद तक कम करने में विफल रहते हैं।

Yuan Huang, Yukang Zhou, Xiangping Chen, Zibin Zheng2026-02-19
🤖 AI

Uncovering Discrimination Clusters: Quantifying and Explaining Systematic Fairness Violations

यह शोध पत्र HyFair को प्रस्तुत करता है, जो एक हाइब्रिड तकनीक है जो औपचारिक प्रतीकात्मक विश्लेषण (formal symbolic analysis) और यादृच्छिक खोज (randomized search) को संयोजित करता है ताकि व्यवस्थित भेदभाव क्लस्टर्स (systematic discrimination clusters)—अर्थात संरक्षित विशेषताओं के आधार पर मनमाने परिणाम परिवर्तनों के ऐसे पैटर्न जो पारंपरिक युग्मवार निष्पक्षता जांचों से अधिक होते हैं—का पता लगाया जा सके और उनकी व्याख्या की जा सके, जिससे उन एल्गोरिदम संबंधी पूर्वाग्रहों को उजागर किया जा सके जिन्हें व्यक्तिगत निष्पक्षता मेट्रिक्स अक्सर अनदेखा कर देते हैं।

Ranit Debnath Akash, Ashish Kumar, Verya Monjezi, Ashutosh Trivedi, Gang, Tan, Saeid Tizpaz-Niari2026-02-19
💻 computer science

Software Testing at the Network Layer: Automated HTTP API Quality Assessment and Security Analysis of Production Web Applications

यह शोध पत्र एक स्वचालित सॉफ़्टवेयर परीक्षण ढांचा प्रस्तुत करता है जो 18 प्रोडक्शन वेबसाइटों में HTTP API इंटरैक्शन की गुणवत्ता और सुरक्षा का मूल्यांकन करता है, जिससे रेडंडेंट अनुरोधों और मिसिंग कैश हेडर जैसे महत्वपूर्ण एंटी-पैटर्न का खुलासा होता है जो विभिन्न साइट श्रेणियों में व्यापक रूप से भिन्न होते हैं।

Ali Hassaan Mughal, Muhammad Bilal, Noor Fatima2026-02-19
💻 computer science

EmoTrack: An application to Facilitate User Reflection on Their Online Behaviours

यह शोध प्रबंध EmoTrack के विकास और मूल्यांकन को प्रस्तुत करता है, जो एक मल्टी-प्लेटफॉर्म पर्सनल इन्फॉर्मेटिक्स एप्लिकेशन है जिसे युवाओं को उनकी यूट्यूब देखने की आदतों को ट्रैक करने और उनके ऑनलाइन व्यवहार के उनके मूड पर पड़ने वाले प्रभाव पर चिंतन करने में मदद करने के लिए डिज़ाइन किया गया है।

Ruiyong Zhang2026-02-19
💻 computer science

Can Causality Cure Confusion Caused By Correlation (in Software Analytics)?

यह अध्ययन इस बात की जांच करता है कि क्या पारंपरिक सहसंबंध-आधारित विधियों की तुलना में प्रतीकात्मक मॉडलों (symbolic models) में कार्य-कारण-जागरूक (causality-aware) विभाजन मानदंडों को एकीकृत करने से सॉफ्टवेयर एनालिटिक्स में उनकी स्थिरता और मजबूती बढ़ सकती है, जबकि भविष्य कहने वाले प्रदर्शन में ट्रेड-ऑफ का मूल्यांकन किया जाता है और इन स्वचालित परिणामों की मानव विशेषज्ञ निर्णयों के विरुद्ध तुलना की जाती है।

Amirali Rayegan, Tim Menzies2026-02-19
🤖 AI

SPARC: Scenario Planning and Reasoning for Automated C Unit Test Generation

SPARC एक न्यूरो-सिम्बोलिक फ्रेमवर्क है जो कंट्रोल फ्लो ग्राफ विश्लेषण, वैलिडेटेड ऑपरेशन मैप्स और इटरेटिव कंपाइलर फीडबैक को जोड़कर उच्च-स्तरीय इंटेंट और C की कठोर बाधाओं के बीच के अंतर को पाटता है, जिससे मौजूदा LLM-आधारित या सिम्बोलिक एक्जीक्यूशन दृष्टिकोणों की तुलना में काफी अधिक प्रभावी और रखरखाव योग्य स्वचालित यूनिट टेस्ट उत्पन्न होते हैं।

Jaid Monwar Chowdhury, Chi-An Fu, Reyhaneh Jabbarvand2026-02-19
💻 computer science

Byam: Fixing Breaking Dependency Updates with Large Language Models

यह शोध पत्र Byam प्रस्तुत करता है, जो डिपेंडेंसी अपडेट के कारण टूटे हुए क्लाइंट कोड को स्वचालित रूप से ठीक करने के लिए लार्ज लैंग्वेज मॉडल्स (LLMs) का लाभ उठाने वाला एक दृष्टिकोण है, जो यह प्रदर्शित करता है कि OpenAI के o3-mini जैसे मॉडल्स संदर्भ संबंधी जानकारी और उन्नत प्रॉम्प्टिंग रणनीतियों के साथ 27% संपूर्ण बिल्ड्स और 78% व्यक्तिगत कंपाइलेशन त्रुटियों को सफलतापूर्वक ठीक कर सकते हैं।

Frank Reyes, May Mahmoud, Federico Bono, Sarah Nadi, Benoit Baudry, Martin Monperrus2026-02-18
💬 NLP

Is Vibe Coding Safe? Benchmarking Vulnerability of Agent-Generated Code in Real-World Tasks

यह शोध पत्र SUSEVIBES बेंचमार्क प्रस्तुत करता है ताकि यह प्रदर्शित किया जा सके कि वर्तमान LLM-आधारित "वाइब कोडिंग" एजेंट, हालांकि अक्सर कार्यात्मक रूप से सही होते हैं, वास्तविक दुनिया के सॉफ्टवेयर इंजीनियरिंग कार्यों में अत्यधिक असुरक्षित कोड उत्पन्न करते हैं, और प्रारंभिक शमन रणनीतियां अप्रभावी सिद्ध होती हैं।

Songwen Zhao, Danqing Wang, Kexun Zhang, Jiaxuan Luo, Zhuo Li, Lei Li2026-02-18
💻 computer science

Is Your Private Information Logged? An Empirical Study on Android App Logs

यह शोध पत्र एंड्रॉइड ऐप लॉग्स पर एक अनुभवजन्य अध्ययन प्रस्तुत करता है जो गोपनीयता लीक की व्यापकता और कारणों का विश्लेषण करता है, डेवलपर्स की चिंताओं की पांच प्रमुख श्रेणियों की पहचान करता है, और इन जोखिमों को कम करने के लिए व्यावहारिक सुझाव प्रदान करता है।

Zhiyuan Chen, Soham Sanjay Deo, Poorna Chander Reddy Puttaparthi, Vanessa Nava-Camal, Yiming Tang, Xueling Zhang, Weiyi (…)2026-02-18