💻 computer science

Investigating Metamorphic Fuzz Oracle Enhancement via Large Language Models

यह शोध पत्र MetaFOE को प्रस्तुत करता है, जो एक LLM-आधारित फ्रेमवर्क है जो क्रैश-आधारित ओरेकल की सीमाओं को दूर करने के लिए फज़ ड्राइवर (fuzz driver) में मेटामॉर्फिक संबंधों को स्वचालित रूप से उत्पन्न और एकीकृत करता है, जिसके परिणामस्वरूप ग्रेबॉक्स फज़िंग (greybox fuzzing) में कोड कवरेज और क्रैश डिटेक्शन में महत्वपूर्ण सुधार होता है।

Ruixiang Qian, Ding Yang, Zengxu Chen, Yuxuan Gao, Chunrong Fang, Chao Zhang, Zhenyu Chen2026-06-15
💻 computer science

Evaluating LLMs for Obfuscation Detection and Classification in Android Apps

यह शोध पत्र एक बड़े पैमाने पर किए गए अनुभवजन्य अध्ययन को प्रस्तुत करता है जो विविध डेटासेट और प्रयोगात्मक स्थितियों में पारंपरिक स्टेटिक एनालिसिस टूल्स के विरुद्ध उनके प्रदर्शन की तुलना करते हुए, सिमेंटिक रीजनिंग के माध्यम से एंड्रॉइड एप्लिकेशन में कोड ऑब्फस्केशन (code obfuscation) का पता लगाने और उसे वर्गीकृत करने की ऑफ-द-शेल्फ लार्ज लैंग्वेज मॉडल्स की क्षमता का मूल्यांकन करता है।

Luca Ferrari, Marco Alecci, Jordan Samhi, Tegawende' F. Bissyande', Jacques Klein, Mariano Ceccato, Luca Verderame2026-06-15
💻 computer science

Security in a Workflow: Exploring Role-Based Agentic Architectures for Vulnerability Handling

यह शोध पत्र एक भूमिका-आधारित एजेंटिक वर्कफ़्लो (Planner, Analyzer, Fixer, और Verifier एजेंटों से युक्त) का प्रस्ताव और मूल्यांकन करता है जो अलग-थलग LLM सुरक्षा कार्यों और वास्तविक दुनिया के औद्योगिक अभ्यासों के बीच के अंतर को पाटने का काम करता है, जो 25 वास्तविक दुनिया की C/C++ कमजोरियों पर 44% भेद्यता पहचान सटीकता और 19% फिक्स सटीकता प्रदर्शित करता है।

Srijita Basu, Miroslaw Staron2026-06-15
🤖 AI

I'm Sorry Driver, I'm Afraid I Can't Do That: Appraising the Safety of LLMs within Automotive Contexts

यह शोध पत्र ऑटोमोटिव नियंत्रण प्रणालियों में लार्ज लैंग्वेज मॉडल्स (LLMs) को एकीकृत करने की सुरक्षा आश्वासन का मूल्यांकन करता है, जो अपस्ट्रीम-डाउनस्ट्रीम संरेखण, विलंबता (latency), और नवीन संरेखण संबंधी मुद्दों जैसे महत्वपूर्ण वैचारिक और इंजीनियरिंग चुनौतियों की पहचान करता है, साथ ही 'Talk2Drive' फ्रेमवर्क के एक केस स्टडी के आधार पर भविष्य के आश्वासन तंत्रों का प्रस्ताव करता है।

Shaun Feakins, Ibrahim Habli, Kim Littler, Robert Palin2026-06-15
🤖 AI

No Accidental Software Agent First Canonical Code for Human Code Entropy Reduction and 30 to 500 times Lower Frontier Model Requirements

यह शोध पत्र "एजेंट-फर्स्ट कैनोनिकल कोड" का प्रस्ताव करता है, जो एक प्रूफ़-कैरिंग सबस्ट्रेट (proof-carrying substrate) है जिसे मानव सॉफ़्टवेयर रिपॉजिटरी से आकस्मिक एंट्रॉपी को हटाने के लिए डिज़ाइन किया गया है, जो समकक्ष एन्कोडिंग को शासित प्रतिनिधियों में संकुचित करके, इस प्रकार फ्रंटियर मॉडल प्रशिक्षण आवश्यकताओं और सत्यापित-परिवर्तन लागतों को 30 से 500 गुना कम करने का लक्ष्य रखता है और एक "नो-एक्सीडेंट होराइजन" की ओर एक असत्यसिद्ध करने योग्य पथ स्थापित करता है।

Jepson Taylor2026-06-15
🤖 AI

When Errors Become Narratives: A Longitudinal Taxonomy of Silent Failures in a Production LLM Agent Runtime

यह शोध पत्र एक प्रोडक्शन एलएलएम (LLM) एजेंट रनटाइम के एक अनुदैर्ध्य अध्ययन (longitudinal study) को प्रस्तुत करता है जो "फेल-प्लॉज़िबल" (fail-plausible) मौन विफलताओं की पहचान करता है—जहाँ सिस्टम त्रुटि संकेतों के बजाय विश्वसनीय लेकिन गलत आख्यान उत्पन्न करता है—और ऐसी एजेंट विफलताओं को मुखर, उत्तरदायी और उबाऊ बनाने के लिए एक पांच-वर्ग वर्गीकरण और रक्षा ढांचा प्रस्तावित करता है।

Wei Wu2026-06-15
🤖 AI

Regulating the Machine Contributor: Governance and Policy Alignment in Open Source

यह शोध पत्र छह प्रमुख संगठनों का परीक्षण करके मौजूदा ओपन-सोर्स योगदान नीतियों और उभरते एआई गवर्नेंस फ्रेमवर्क के बीच के मिसअलाइनमेंट (विसंगति) का विश्लेषण करता है, एक छह-आयामी वर्गीकरण के माध्यम से महत्वपूर्ण नियामक अंतराल की पहचान करता है, और स्वायत्त एआई योगदानकर्ताओं द्वारा उत्पन्न चुनौतियों को संबोधित करने के लिए एक सामंजस्यपूर्ण टियर्ड (स्तरित) ढांचे का प्रस्ताव करता है।

Jassem Manita, Aziz Amari2026-06-15
💻 computer science

GitHub Template Repositories: Served Domains, Maintenance, and Practitioner Guidelines

यह शोध पत्र पांच प्रोग्रामिंग भाषाओं में गिटहब (GitHub) टेम्पलेट रिपॉजिटरीज़ का एक बड़े पैमाने पर अनुभवजन्य अध्ययन प्रस्तुत करता है ताकि उनके अनुप्रयोग डोमेन, रखरखाव की विशेषताओं और गुणवत्ता संबंधी समस्याओं का विश्लेषण किया जा सके, और अंततः प्रभावी टेम्पलेट प्रोजेक्ट्स को डिजाइन करने और प्रबंधित करने के लिए व्यावहारिक दिशा-निर्देश प्राप्त किए जा सकें।

Leuson Da Silva, Altaf Allah Abbassi, Imen Trabelsi, Paulo Borba, Foutse Khomh2026-06-15
💻 computer science

Teaching Machine Learning to Software Engineers

यह शोध पत्र एक संरचित विषय सूची को परिभाषित करके, पाठ्यक्रम मानचित्रण के माध्यम से कवरेज अंतराल की पहचान करके, और मौजूदा पाठ्यक्रमों में उच्च-प्राथमिकता वाले एमएल (ML) अवधारणाओं को एकीकृत करने के लिए साक्ष्य-आधारित दिशा-निर्देश प्राप्त करने हेतु प्रशिक्षकों का सर्वेक्षण करके, एआई/एमएल (AI/ML) प्रणालियों के संबंध में स्नातक सॉफ्टवेयर इंजीनियरिंग पाठ्यक्रमों में मौजूद अंतराल को संबोधित करता है।

Nafiseh Kahani, Jason Jaskolka2026-06-15
⚛️ quantum physics

Quasilinear Equivalence Checking for Detector Error Models

यह शोधपत्र डिटेक्टर एरर मॉडल्स (DEMs) के लिए एक सुदृढ़ (sound), समापन योग्य (terminating) और सुसंगत (confluent) रीराइटिंग सिस्टम प्रस्तुत करता है जो क्वाज़िलिनियर समय में अद्वितीय नॉर्मल फॉर्म्स की गणना करता है, जो गैर-अनुकूली (non-adaptive) क्वांटम एरर करेक्शन पाइपलाइनों में डिकोडर तुल्यता को सत्यापित करने के लिए पहला पूर्ण स्टेटिक निर्णय प्रक्रिया (static decision procedure) और आंशिक-अनुकूली (partially-adaptive) सर्किटों के लिए एक स्केलेबल दृष्टिकोण प्रदान करता है।

Mathys Rennela2026-06-15