💻 computer science

Hallucination Inspector: A Fact-Checking Judge for API Migration

यह शोध पत्र 'हैलुसिनेशन इंस्पेक्टर' (Hallucination Inspector) को प्रस्तुत करता है, जो एक स्टैटिक एनालिसिस टूल है जो API डॉक्यूमेंटेशन के विरुद्ध निकाले गए प्रतीकों (symbols) को सत्यापित करके LLM-जनरेटेड API माइग्रेशन कोड में "स्कैफोल्डिंग हेलुसिनेशन्स" (scaffolding hallucinations) का पता लगाता है, जिससे मानक मेट्रिक्स और संभाव्य जजों (probabilistic judges) की सीमाओं को दूर किया जा सके।

Marcos Tileria, Santanu Kumar Dash, Profir-Petru Pârţachi, Earl T. Barr2026-04-23
💻 computer science

Towards Secure Logging: Characterizing and Benchmarking Logging Code Security Issues with LLMs

यह शोध पत्र कोड सुरक्षा संबंधी समस्याओं को लॉग करने के लिए एक व्यापक वर्गीकरण और बेंचमार्क डेटासेट प्रस्तुत करता है, जो इन कमजोरियों का पता लगाने और उन्हें ठीक करने के लिए लार्ज लैंग्वेज मॉडल्स (LLMs) की क्षमताओं का मूल्यांकन करता है और यह प्रकट करता है कि जहाँ LLMs मध्यम पहचान सटीकता दिखाते हैं, वहीं वे सही कोड सुधारों को विश्वसनीय रूप से उत्पन्न करने में संघर्ष करते हैं।

He Yang Yuan, Xin Wang, Kundi Yao, An Ran Chen, Zishuo Ding, Zhenhao Li2026-04-23
💻 computer science

On the Informativeness of Security Commit Messages: A Large-scale Replication Study

यह बड़े पैमाने पर किया गया प्रतिकृति अध्ययन (replication study) पूर्व निष्कर्षों की पुष्टि और विस्तार करता है कि सुरक्षा-संबंधित कमिट संदेश (commit messages) आम तौर पर पैच ट्राइएज (patch triage) के लिए सूचनात्मक नहीं होते हैं, जो यह प्रकट करता है कि उनकी गुणवत्ता समय के साथ बिगड़ रही है, विभिन्न सॉफ्टवेयर पारिस्थित प्रणालियों में काफी भिन्न होती है, और विरोधाभासी रूप से कन्वेंशनल कमिट्स स्पेसिफिकेशन (Conventional Commits Specification) का पालन करने वाले कमिट्स में कम है।

Syful Islam, Stefano Zacchiroli2026-04-23
💻 computer science

Early-Stage Product Line Validation Using LLMs: A Study on Semi-Formal Blueprint Analysis

यह अध्ययन प्रदर्शित करता है कि रीजनिंग-ऑप्टिमाइज़्ड लार्ज लैंग्वेज मॉडल्स, सॉफ्टवेयर प्रोडक्ट लाइन के प्रारंभिक सत्यापन के लिए अर्ध-औपचारिक टेक्स्टुअल ब्लूप्रिंट्स का विश्लेषण करने में, पारंपरिक सॉल्वर-आधारित दृष्टिकोणों के एक हल्के विकल्प के रूप में (88–89%) लगभग सॉल्वर सटीकता प्राप्त कर सकते हैं, बावजूद इसके कि व्यवस्थित पार्सिंग और रीजनिंग त्रुटियों की पहचान की गई है।

Viet-Man Le, Thi Ngoc Trang Tran, Sebastian Lubos, Alexander Felfernig, Damian Garber2026-04-23
💻 computer science

DeepParse: Hybrid Log Parsing with LLM-Synthesized Regex Masks

DeepParse एक हाइब्रिड लॉग पार्सिंग फ्रेमवर्क है जो छोटे नमूनों से पुन: प्रयोज्य वेरिएबल पैटर्न को स्वचालित रूप से खोजने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है और उन्हें कुशल Drain एल्गोरिदम के माध्यम से लागू करता है, जिससे पारंपरिक ह्यूरिस्टिक और केवल LLM दृष्टिकोणों की तुलना में बेहतर सटीकता और लागत-दक्षता प्राप्त होती है।

Amir Shetaia, Sean Kauffman2026-04-23
🤖 machine learning

Evaluating Assurance Cases as Text-Attributed Graphs for Structure and Provenance Analysis

यह शोध पत्र एक ग्राफ डायग्नोस्टिक फ्रेमवर्क प्रस्तावित करता है जो एश्योरेंस केसेस (assurance cases) को टेक्स्ट-एट्रीब्यूटेड ग्राफ के रूप में मॉडल करता है, यह प्रदर्शित करते हुए कि ग्राफ न्यूरल नेटवर्क लिंक प्रेडिक्शन करने में प्रभावी ढंग से कार्य करते हैं और विशिष्ट पदानुक्रमित लिंकिंग पैटर्न की पहचान करके मानव-लिखित और एलएलएम-जनरेटेड (LLM-generated) केसेस के बीच अंतर करते हैं, जबकि साथ ही यह तर्क संरचना की सत्यनिष्ठा (argument structure faithfulness) के संबंध में वर्तमान स्पष्टीकरण विधियों की सीमाओं को भी उजागर करता है।

Fariz Ikhwantri, Dusica Marijan2026-04-23
💻 computer science

QuanForge: A Mutation Testing Framework for Quantum Neural Networks

यह शोध पत्र QuanForge को प्रस्तुत करता है, जो क्वांटम न्यूरल नेटवर्क के लिए एक नवीन म्यूटेशन टेस्टिंग फ्रेमवर्क है जो प्रभावी म्यूटेंट्स को व्यवस्थित रूप से उत्पन्न करने के लिए सांख्यिकीय म्यूटेशन किलिंग और नौ पोस्ट-ट्रेनिंग ऑपरेटर्स का उपयोग करता है, जिससे QNNs के सुदृढ़ टेस्ट सुइट मूल्यांकन, भेद्यता स्थानीयकरण (vulnerability localization), और शोर-लचीले संरचनात्मक मूल्यांकन को सक्षम बनाया जा सके।

Minqi Shao, Shangzhou Xia, Jianjun Zhao2026-04-23
💻 computer science

SWE-chat: Coding Agent Interactions From Real Users in the Wild

यह शोध पत्र SWE-chat को प्रस्तुत करता है, जो ओपन-सोर्स डेवलपर्स से वास्तविक दुनिया के कोडिंग एजेंट इंटरैक्शन का पहला बड़े पैमाने पर, निरंतर अपडेट किया जाने वाला डेटासेट है, जो यह प्रकट करता है कि हालांकि उपयोग पैटर्न द्वि-आयामी (bimodal) हैं, एजेंट वर्तमान में कम कोड उत्तरजीविता दर (code survival rates), उच्च सुरक्षा कमजोरियां और बार-बार उपयोगकर्ता का विरोध प्रदर्शित करते हैं, जो क्यूरेटेड बेंचमार्क से परे साक्ष्य-आधारित सुधारों की आवश्यकता को रेखांकित करता है।

Joachim Baumann, Vishakh Padmakumar, Xiang Li, John Yang, Diyi Yang, Sanmi Koyejo2026-04-23
💻 computer science

A Scalable Game-Theoretic Approach for Selecting Security Controls from Standardized Catalogues

यह शोध पत्र एक स्केलेबल, गेम-थ्योरेटिक दृष्टिकोण और सहायक सॉफ्टवेयर टूल प्रस्तुत करता है जो ITSG-33 जैसे मानकीकृत कैटलॉग से नियंत्रणों (controls) के इष्टतम, बजट-बाधित संयोजनों की पहचान करने के लिए, नियंत्रण निर्भरताओं और हमलावर प्रोफाइल को ध्यान में रखते हुए, सुरक्षा नियंत्रण चयन को दो-पक्षीय शून्य-योग खेल (two-person zero-sum game) के रूप में मॉडल करता है।

Dylan Léveillé, Jason Jaskolka2026-04-22
💻 computer science

Enforcing Control Flow Integrity on DeFi Smart Contracts

यह शोध पत्र CrossGuard को प्रस्तुत करता है, जो एक नवीन ऑन-चेन फ्रेमवर्क है जो रनटाइम व्हाइटलिस्टिंग के माध्यम से कंट्रोल फ्लो इंटीग्रिटी को लागू करके DeFi स्मार्ट कॉन्ट्रैक्ट सुरक्षा को बढ़ाता है, जो विशिष्ट एक्सप्लॉइट्स के पूर्व ज्ञान की आवश्यकता के बिना न्यूनतम फाल्स पॉजिटिव और गैस ओवरहेड के साथ 37 ऐतिहासिक हमलों में से 35 को प्रभावी ढंग से रोकता है।

Zhiyang Chen, Sidi Mohamed Beillahi, Pasha Barahimi, Cyrus Minwalla, Han Du, Andreas Veneris, Fan Long2026-04-22