💻 computer science

Intent Formalization: A Grand Challenge for Reliable Coding in the Age of AI Agents

यह शोध पत्र तर्क देता है कि "इरादा औपचारिकीकरण" (intent formalization)—अनौपचारिक उपयोगकर्ता आवश्यकताओं का जांच योग्य औपचारिक विशिष्टताओं में अनुवाद—AI-जनित कोड की विश्वसनीयता सुनिश्चित करने के लिए महत्वपूर्ण चुनौती है, जो इन विशिष्टताओं को मान्य करने के लिए नए मेट्रिक्स और मानव-AI संपर्क विधियों की आवश्यकता पर प्रकाश डालते हुए हल्के परीक्षणों से लेकर पूर्ण सत्यापन तक के दृष्टिकोणों के एक स्पेक्ट्रम का प्रस्ताव करता है।

Shuvendu K. Lahiri2026-03-19
💻 computer science

Requirements Volatility in Software Architecture Design: An Exploratory Case Study

यह खोजपूर्ण केस स्टडी इस बात की जांच करती है कि आवश्यकताओं की अस्थिरता (requirements volatility) सॉफ्टवेयर आर्किटेक्चर डिज़ाइन को कैसे प्रभावित करती है, जिसमें अनिश्चितता और गतिशील व्यावसायिक वातावरण जैसे इसके मूल कारणों की पहचान की गई है, और शेड्यूलिंग संबंधी कठिनाइयों तथा तकनीकी ऋण (technical debt) जैसी परिणामी चुनौतियों को रेखांकित करते हुए सॉफ्टवेयर आर्किटेक्ट्स के लिए शमन रणनीतियों (mitigation strategies) का प्रस्ताव दिया गया है।

Sanja Aaramaa, Sandun Dasanayake, Markku Oivo, Jouni Markkula, Samuli Saukkonen2026-03-19
💬 NLP

CodeScout: An Effective Recipe for Reinforcement Learning of Code Search Agents

यह शोध पत्र CodeScout को प्रस्तुत करता है, जो एक सुदृढीकरण लर्निंग (reinforcement learning) फ्रेमवर्क है जो केवल एक मानक Unix टर्मिनल का उपयोग करके कोडिंग एजेंटों को प्रशिक्षित करता है ताकि कई बेंचमार्क पर बेहतर या प्रतिस्पर्धी कोड लोकलाइजेशन प्रदर्शन प्राप्त किया जा सके, जो जटिल विशिष्ट उपकरणों पर निर्भर हुए बिना काफी बड़े मॉडलों से बेहतर प्रदर्शन करता है।

Lintang Sutawika, Aditya Bharat Soni, Bharath Sriraam R R, Apurva Gandhi, Taha Yassine, Sanidhya Vijayvargiya, Yuchen Li (…)2026-03-19
💻 computer science

ArchBench: Benchmarking Generative-AI for Software Architecture Tasks

यह शोध पत्र ArchBench को प्रस्तुत करता है, जो एक एकीकृत प्लेटफॉर्म है जिसमें एक CLI टूल, वेब इंटरफेस और प्लगइन आर्किटेक्चर शामिल है, जिसे सॉफ्टवेयर आर्किटेक्चर कार्यों पर जनरेटिव AI क्षमताओं के बेंचमार्किंग और तुलना करने के लिए डिज़ाइन किया गया है, जो कोड कार्यान्वयन की शुद्धता से परे मानकीकृत मूल्यांकन की वर्तमान कमी को संबोधित करता है।

Bassam Adnan, Aviral Gupta, Sreemaee Akshathala, Karthik Vaidhyanathan2026-03-19
🤖 machine learning

scicode-lint: Detecting Methodology Bugs in Scientific Python Code with LLM-Generated Patterns

यह शोध पत्र scicode-lint को प्रस्तुत करता है, जो एक टिकाऊ, LLM-संचालित दो-स्तरीय उपकरण है जो पायथन कोड में डेटा लीकेज जैसे सूक्ष्म वैज्ञानिक बगों का पता लगाने के लिए स्वचालित रूप से कार्यप्रणाली-जांच पैटर्न उत्पन्न करता है, जिससे पारंपरिक स्टेटिक एनालिसिस टूल्स की इंजीनियरिंग सीमाओं को पार करते हुए उच्च सटीकता प्राप्त होती है।

Sergey V. Samsonau2026-03-19
💻 computer science

In Perfect Harmony: Orchestrating Causality in Actor-Based Systems

यह शोध पत्र ACTORCHESTRA को प्रस्तुत करता है, जो Erlang के लिए एक रनटाइम वेरिफिकेशन फ्रेमवर्क है जो कोड इंजेक्शन के माध्यम से मल्टी-एक्टर इंटरैक्शन में कारण संबंधी संबंधों (causal relationships) को स्वचालित रूप से ट्रैक करता है और न्यूनतम सिस्टम संशोधन के साथ जटिल व्यवहार संबंधी उल्लंघनों का पता लगाने के लिए WALTZ स्पेसिफिकेशन लैंग्वेज प्रदान करता है।

Vladyslav Mikytiv, Bernardo Toninho, Carla Ferreira2026-03-19
🤖 AI

Toward Scalable Automated Repository-Level Datasets for Software Vulnerability Detection

यह डॉक्टरेट शोध वास्तविक कोडबेस में यथार्थवादी कमजोरियों को इंजेक्ट करके और भेद्यता-प्रमाण (proof-of-vulnerability) शोषणों को संश्लेषित करके, स्केलेबल, सटीक रूप से लेबल किए गए रिपॉजिटरी-स्तरीय डेटासेट उत्पन्न करने के लिए एक स्वचालित ढांचे का प्रस्ताव करता है, जबकि भेद्यता पहचान एजेंटों की मजबूती को बढ़ाने के लिए एक एडवरसेरियल को-इवोल्यूशन लूप का उपयोग करता है।

Amine Lbath2026-03-19
🤖 AI

LLAMAFUZZ: Large Language Model Enhanced Greybox Fuzzing

LLAMAFUZZ एक नवीन ग्रेबॉक्स फज़र है जो संरचित इनपुट को प्रभावी ढंग से उत्पन्न करने और उत्परिवर्तित करने के लिए लार्ज लैंग्वेज मॉडल्स के प्री-ट्रेन्ड ज्ञान और फाइन-ट्यून्ड क्षमताओं का लाभ उठाता है, जो विभिन्न वास्तविक दुनिया के प्रोग्रामों में कोड कवरेज और बग डिस्कवरी के मामले में AFL++ जैसे मौजूदा टूल्स से काफी बेहतर प्रदर्शन करता है।

Hongxiang Zhang, Yuyang Rong, Yifeng He, Hao Chen2026-03-18
💻 computer science

ICCheck: A Portable, Language-Agnostic Tool for Synchronizing Code Clones

यह शोध पत्र ICCheck को प्रस्तुत करता है, जो एक पोर्टेबल और भाषा-अज्ञेय (language-agnostic) टूल है जो विविध प्रोग्रामिंग भाषाओं और विकास परिवेशों में विसंगत कोड क्लोन संशोधनों का कुशलतापूर्वक पता लगाने और इंटरैक्टिव सिंक्रोनाइज़ेशन सुझाव प्रदान करने के लिए मौजूदा Git रिपॉजिटरी और लैंग्वेज सर्वर प्रोटोकॉल का लाभ उठाता है।

Motoki Abe, Shinpei Hayashi2026-03-18
💻 computer science

Metamorphic Testing of Vision-Language Action-Enabled Robots

यह शोध पत्र विजन-लैंग्वेज-एक्शन (Vision-Language-Action) रोबोट्स में टेस्ट ऑरेकल समस्या को संबोधित करने के लिए विशिष्ट संबंधों के साथ एक सामान्यीकरण योग्य मेटामॉर्फिक टेस्टिंग फ्रेमवर्क प्रस्तावित करता है, जो यह प्रदर्शित करता है कि यह बिना किसी स्पष्ट टेस्ट ऑरेकल की आवश्यकता के विभिन्न मॉडलों, रोबोटों और कार्यों में विविध विफलताओं का प्रभावी ढंग से पता लगा सकता है।

Pablo Valle, Sergio Segura, Shaukat Ali, Aitor Arrieta2026-03-18