🤖 machine learning

Smart Learning to Find Dumb Contracts (Extended Version)

यह शोध पत्र DLVA को प्रस्तुत करता है, जो एक डीप लर्निंग-आधारित प्रणाली है जो कोड को वेक्टर्स में मैप करके और न्यूरल नेटवर्क का उपयोग करके एथेरियम स्मार्ट कॉन्ट्रैक्ट बाइटकोड का तेजी से और सटीक रूप से विश्लेषण करती है ताकि गति और सटीकता दोनों में Slither जैसे मौजूदा उपकरणों से बेहतर प्रदर्शन किया जा सके।

Tamer Abdelaziz, Aquinas Hobor2026-03-19
🤖 machine learning

Code Roulette: How Prompt Variability Affects LLM Code Generation

यह शोध पत्र कोड जनरेशन में प्रॉम्प्ट विविधताओं के प्रति लार्ज लैंग्वेज मॉडल्स की संवेदनशीलता को मापने के लिए एक प्रोग्रामिंग-टास्क-अग्नोस्टिक मूल्यांकन पाइपलाइन प्रस्तावित करता है, जो व्यापक प्रयोगों और ओपन-सोर्स टूल्स द्वारा समर्थित है।

Andrei Paleyes, Radzim Sendyka, Diana Robinson, Christian Cabrera, Neil D. Lawrence2026-03-19
💬 NLP

ToolRegistry: A Protocol-Agnostic Tool Management Library for Function-Calling LLMs

यह शोध पत्र ToolRegistry को प्रस्तुत करता है, जो एक मॉड्यूलर, प्रोटोकॉल-अज्ञेय (protocol-agnostic) इकोसिस्टम है जो एक कोर रजिस्ट्री, सर्वर एडेप्टर और प्रोडक्शन-रेडी टूल्स के क्यूरेटेड हब के माध्यम से टूल प्रबंधन, निष्पादन और एकीकरण को एकीकृत करके LLM अनुप्रयोगों के लिए विकास ओवरहेड को काफी कम करता है और प्रदर्शन में सुधार करता है।

Peng Ding2026-03-19
💻 computer science

Semantics-Aligned, Curriculum-Driven, and Reasoning-Enhanced Vulnerability Repair Framework

वर्तमान स्वचालित भेद्यता मरम्मत (vulnerability repair) विधियों की सामान्यीकरण और तर्क संबंधी सीमाओं को दूर करने के लिए, यह शोध पत्र SeCuRepair का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो अनदेखी कोडबेस पर मरम्मत की सटीकता में उल्लेखनीय सुधार करने के लिए 'रीज़न-देन-एडिट' (reason-then-edit) प्रतिमान, सिमेंटिक्स-अवेयर सुदृढीकरण शिक्षण (semantics-aware reinforcement learning), और डिफिकल्टी-अवेयर करिकुलम लर्निंग (difficulty-aware curriculum learning) को एकीकृत करता है।

Chengran Yang, Ting Zhang, Jinfeng Jiang, Xin Zhou, Haoye Tian, Mingzhe Du, Jieke Shi, Junkai Chen, Yikun Li, Eng Lieh O (…)2026-03-19
💻 computer science

Improving IR-based Bug Localization with Semantics-Driven Query Reduction

यह शोध पत्र IQLoc का प्रस्ताव करता है, जो एक नवीन बग लोकलाइजेशन दृष्टिकोण है जो कोड अर्थ विज्ञान (semantics) को समझने और खोज प्रश्नों को पुनर्गठित करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जिससे विविध बग रिपोर्ट प्रकारों और बेंचमार्क डेटासेटों में पारंपरिक सूचना पुनर्प्राप्ति (Information Retrieval) विधियों के प्रदर्शन को महत्वपूर्ण रूप से बढ़ाया जा सकता है।

Asif Mohammed Samir, Mohammad Masudur Rahman2026-03-19
💻 computer science

ProofWright: Towards Agentic Formal Verification of CUDA

प्रूफराइट (ProofWright) एक एजेंटिक सत्यापन ढांचा है जो एलएलएम-आधारित कोड जनरेशन के साथ स्वचालित औपचारिक विधियों को एकीकृत करता है ताकि एलएलएम-जनरेटेड CUDA कर्नेल के लिए स्केलेबल, एंड-टू-एंड सुरक्षा और शुद्धता गारंटी प्रदान की जा सके, जो प्रभावी रूप से तीव्र विकास और विश्वसनीय सत्यापन के बीच के अंतर को पाटता है।

Bodhisatwa Chatterjee, Drew Zagieboylo, Sana Damani, Siva Hari, Christos Kozyrakis2026-03-19
💻 computer science

LLMs-Powered Real-Time Fault Injection: An Approach Toward Intelligent Fault Test Cases Generation

यह शोध पत्र कार्यात्मक सुरक्षा आवश्यकताओं (functional safety requirements) से वास्तविक समय के फॉल्ट इंजेक्शन टेस्ट केस को स्वचालित रूप से उत्पन्न करने के लिए लार्ज लैंग्वेज मॉडल्स, विशेष रूप से gpt-4o का लाभ उठाने वाले एक नवीन दृष्टिकोण का प्रस्ताव करता है, जिससे वर्तमान विधियों की मैनुअल सीमाओं को दूर किया जा सके और ऑटोमोटिव सॉफ्टवेयर सिस्टम के दक्षता और सुरक्षा सत्यापन में महत्वपूर्ण सुधार किया जा सके।

Mohammad Abboush, Ahmad Hatahet, Andreas Rausch2026-03-19
💬 NLP

APEX-SWE

यह शोध पत्र APEX-SWE को प्रस्तुत करता है, जो एक नया बेंचमार्क है और सिस्टम इंटीग्रेशन तथा प्रोडक्शन डिबगिंग जैसे आर्थिक रूप से मूल्यवान, वास्तविक दुनिया के सॉफ्टवेयर इंजीनियरिंग कार्यों पर फ्रंटियर AI मॉडल्स का मूल्यांकन करता है, जिससे यह पता चलता है कि शीर्ष प्रदर्शन करने वाले मॉडल्स मुख्य रूप से एपिस्टेमिक अनुशासन (epistemic discipline) और व्यवस्थित सत्यापन (systematic verification) के माध्यम से सफलता प्राप्त करते हैं।

Abhi Kottamasu, Chirag Mahapatra, Sam Lee, Ben Pan, Aakash Barthwal, Akul Datta, Ajay Arun, Silas Alberti, Adarsh Hirema (…)2026-03-19
💻 computer science

Linting Style and Substance in READMEs

यह शोध पत्र LintMe को प्रस्तुत करता है, जो एक डिज़ाइन प्रोब (design probe) है जो प्रोग्रामेटिक जांच को LLM-आधारित सामग्री मूल्यांकन के साथ जोड़कर उपयोगकर्ताओं को संदर्भ-विशिष्ट README लिंटर्स बनाने में सक्षम बनाता है, और उपयोगकर्ता अध्ययनों के माध्यम से यह प्रदर्शित करता है कि यह हाइब्रिड दृष्टिकोण लेखक की एजेंसी के साथ स्वचालित शैली और विषय-वस्तु सुधारों को प्रभावी ढंग से संतुलित करता है।

Hima Mynampaty, Nathania Josephine, Katherine E. Isaacs, Andrew M. McNutt2026-03-19
💻 computer science

LLM Use, Cheating, and Academic Integrity in Software Engineering Education

116 सॉफ्टवेयर इंजीनियरिंग छात्रों का यह अध्ययन प्रकट करता है कि रिपोर्ट की गई एलएलएम (LLM) के दुरुपयोग का मुख्य कारण जागरूकता की कमी के बजाय समय का दबाव और अस्पष्ट मूल्यांकन दिशानिर्देश हैं, जो एआई (AI) टूल के उपयोग के लिए विकसित होती अपेक्षाओं के साथ पाठ्यक्रम डिजाइन को बेहतर ढंग से संरेखित करने की आवश्यकता पर बल देता है।

Ronnie de Souza Santos, Italo Santos, Maria Bento, Giuseppe Destefanis, Cleyton Magalhães, Mairieli Wessel2026-03-19