💻 computer science

AndroScanner: Automated Backend Vulnerability Detection for Android Applications

यह शोध पत्र AndroScanner को प्रस्तुत करता है, जो एक स्वचालित पाइपलाइन है जो एंड्रॉइड अनुप्रयोगों में OWASP API सुरक्षा शीर्ष 10 के विरुद्ध बैकएंड कमजोरियों का पता लगाने के लिए स्टैटिक और डायनेमिक विश्लेषण को जोड़ता है, जिसने एक प्रोडक्शन ऐप में ज़ीरो-डे 'एक्सेसिव डेटा एक्सपोज़र' (Excessive Data Exposure) सहित पांच खामियों की सफलतापूर्वक पहचान की है।

Harini Dandu2026-04-17
🤖 AI

Asking What Matters: Reward-Driven Clarification for Software Engineering Tasks

यह शोध पत्र CLARITI को प्रस्तुत करता है, जो एक 8B-पैरामीटर वाला मॉडल है जिसे रिवॉर्ड-ड्रिवन रिइन्फोर्समेंट लर्निंग के माध्यम से प्रशिक्षित किया गया है जो कार्य-प्रासंगिक और उपयोगकर्ता-उत्तर देने योग्य जानकारी को प्राथमिकता देकर सॉफ्टवेयर इंजीनियरिंग में स्पष्टीकरण दक्षता को अनुकूलित करता है, और 41% कम प्रश्नों के साथ GPT-5-स्तर की समाधान दर प्राप्त करता है।

Sanidhya Vijayvargiya, Vijay Viswanathan, Graham Neubig2026-04-17
🤖 machine learning

AIPC: Agent-Based Automation for AI Model Deployment with Qualcomm AI Runtime

यह शोध पत्र AIPC को प्रस्तुत करता है, जो एक AI एजेंट-संचालित फ्रेमवर्क है जो AI मॉडलों को क्वालकॉम AI रनटाइम (Qualcomm AI Runtime) जैसे हार्डवेयर-विशिष्ट रनटाइम्स पर तैनात करने की जटिल, बहु-चरणीय प्रक्रिया को स्वचालित करता है, जिससे इंजीनियरिंग समय और विशेषज्ञता की आवश्यकताओं में उल्लेखनीय कमी आती है और मानक विजन मॉडलों के लिए मिनटों में तैनाती प्राप्त की जा सकती है।

Jianhao Su, Zhanwei Wu, ShengTing Huang, Weidong Feng2026-04-17
🤖 AI

Bounded Autonomy for Enterprise AI: Typed Action Contracts and Consumer-Side Execution

यह शोध पत्र एंटरप्राइज एआई के लिए एक "बाउंडेड ऑटोनॉमी" (सीमित स्वायत्तता) आर्किटेक्चर का प्रस्ताव और मूल्यांकन करता है जो लार्ज लैंग्वेज मॉडल्स को टाइप किए गए कॉन्ट्रैक्ट्स और कंज्यूमर-साइड निष्पादन सीमाओं के भीतर क्रियाएं प्रस्तावित करने के लिए बाध्य करता है, यह प्रदर्शित करते हुए कि यह दृष्टिकोण मैनुअल ऑपरेशन की तुलना में पर्याप्त गति बनाए रखते हुए, अनियंत्रित एआई की तुलना में सुरक्षा और कार्य सफलता दरों में महत्वपूर्ण सुधार करता है।

Sarmad Sohail, Ghufran Haider2026-04-17
🤖 AI

Benchmarks for Trajectory Safety Evaluation and Diagnosis in OpenClaw and Codex: ATBench-Claw and ATBench-CodeX

यह शोध पत्र ATBench-Claw और ATBench-CodeX को प्रस्तुत करता है, जो ATBench फ्रेमवर्क के दो डोमेन-विशिष्ट विस्तार हैं, जो OpenClaw और OpenAI Codex निष्पादन वातावरणों में प्रक्षेपवक्र-स्तर (trajectory-level) के सुरक्षा जोखिमों का मूल्यांकन और निदान करने के लिए एक अनुकूलित त्रि-आयामी सुरक्षा वर्गीकरण (taxonomy) का उपयोग करते हैं।

Zhonghao Yang, Yu Li, Yanxu Zhu, Tianyi Zhou, Yuejin Xie, Haoyu Luo, Jing Shao, Xia Hu, Dongrui Liu2026-04-17
💻 computer science

Towards Understanding Android APIs: Official Lists, Vendor Customizations, and Real-World Usage

यह शोध पत्र यह प्रकट करने वाला पहला अनुभवजन्य अध्ययन प्रस्तुत करता है कि आधिकारिक एंड्रॉइड एपीआई (API) सूचियाँ न तो स्थिर हैं और न ही परस्पर सुसंगत हैं, जो यह प्रदर्शित करता है कि उनकी विसंगतियाँ अनुसंधान के परिणामों को महत्वपूर्ण रूप से प्रभावित करती हैं और वास्तविक दुनिया के अनुप्रयोगों में वेंडर-अनुकूलित (vendor-customized) एपीआई की अनदेखी की गई व्यापकता को उजागर करती हैं।

Sinan Wang, Qi Zhang, Jiacheng Li, Lili Wei, Yida Tao, Yepang Liu2026-04-17
💻 computer science

Enhancing Large Language Models with Retrieval Augmented Generation for Software Testing and Inspection Automation

यह शोध पत्र सॉफ्टवेयर परीक्षण और निरीक्षण को स्वचालित करने में लार्ज लैंग्वेज मॉडल्स को बेहतर बनाने के लिए एक रिट्रीवल ऑगमेंटेड जनरेशन (RAG) पाइपलाइन का प्रस्ताव करता है, जो यह प्रदर्शित करता है कि बाहरी संदर्भ को एकीकृत करना प्रभावी रूप से मतिभ्रम (hallucinations) को कम करता है, V&V दक्षता में सुधार करता है, और परियोजना लागत को कम करता है।

Zoe Fingleton, Nazanin Siavash, Armin Moin2026-04-17
💻 computer science

BugScope: Learn to Find Bugs Like Human

BugScope एक ऐसा फ्रेमवर्क है जो मानव ऑडिटर्स की नकल करने के लिए बग डिटेक्शन को सीड आइडेंटिफिकेशन (seed identification), कॉन्टेक्स्ट रिट्रीवल (context retrieval) और डिस्टिल्ड गाइडलाइन्स (distilled guidelines) द्वारा निर्देशित बग डिटेक्शन में संरचित करता है, जिससे अग्रणी औद्योगिक उपकरणों की तुलना में काफी अधिक प्रिसिजन (precision) और रिकॉल (recall) प्राप्त होता है और लिनक्स कर्नेल जैसे प्रोजेक्ट्स में कई वास्तविक दुनिया के बग्स को सफलतापूर्वक उजागर किया गया है।

Jinyao Guo, Chengpeng Wang, Dominic Deluca, Jinjie Liu, Zhuo Zhang, Xiangyu Zhang2026-04-16
💻 computer science

Human-aligned AI Model Cards with Weighted Hierarchy Architecture

यह शोध पत्र व्यापक उत्तरदायी एआई मॉडल कार्ड फ्रेमवर्क (CRAI-MCF) को प्रस्तुत करता है, जो एक मूल्य-संरेखित, आठ-मॉड्यूल आर्किटेक्चर है जो स्थिर मॉडल दस्तावेज़ीकरण को एक मात्रात्मक, मानव-संरेखित प्रणाली में परिवर्तित करता है ताकि लार्ज लैंग्वेज मॉडल्स की कठोर क्रॉस-मॉडल तुलना और उत्तरदायी अंगीकरण को सक्षम किया जा सके।

Pengyue Yang, Haolin Jin, Qingwen Zeng, Jiawen Wen, Harry Rao, Huaming Chen2026-04-16
🤖 AI

VeruSAGE: A Study of Agent-Based Verification for Rust Systems

यह शोधपत्र VeruSAGE-Bench को प्रस्तुत करता है, जो आठ ओपन-सोर्स Verus-वेरिफाइड Rust सिस्टम से 849 प्रूफ कार्यों का एक नया बेंचमार्क है, और यह प्रदर्शित करता है कि अनुकूलित LLM-एजेंट संयोजन इन कार्यों में से 80% से अधिक और अधूरे सिस्टम प्रूफ के 90% से अधिक को सफलतापूर्वक हल कर सकते हैं, जो सिस्टम सॉफ्टवेयर के लिए AI-सहायता प्राप्त सत्यापन की महत्वपूर्ण क्षमता को उजागर करता है।

Chenyuan Yang, Natalie Neamtu, Chris Hawblitzel, Jacob R. Lorch, Shan Lu2026-04-16