🤖 AI

LLM-Assisted Repository-Level Generation with Structured Spec-Driven Engineering

यह शोधपत्र स्ट्रक्चर्ड स्पेक-ड्रिवन इंजीनियरिंग (SSDE) का प्रस्ताव करता है, जो एक ऐसा प्रतिमान (पैराडाइम) है जो प्राकृतिक भाषा के प्रॉम्प्ट्स की अस्पष्टता और गुणवत्ता संबंधी सीमाओं को दूर करने के लिए संरचित विनिर्देशों (स्ट्रक्चर्ड स्पेसिफिकेशन्स) का उपयोग करता है, जिससे रिपॉजिटरी स्तर पर उच्च-गुणवत्ता वाले, सत्यापन योग्य कोड जनरेशन को सक्षम बनाया जा सके।

Shuzhao Feng, Boqi Chen, Brett H Meyer, Gunter Mussbacher2026-05-06✓ Author reviewed
🤖 AI

Standing on the Shoulders of Giants: Stabilized Knowledge Distillation for Cross--Language Code Clone Detection

यह शोध पत्र एक स्थिर ज्ञान आसवन (knowledge distillation) ढांचे का प्रस्ताव करता है जो DeepSeek-R1 मॉडल से तर्क करने की क्षमताओं को संक्षिप्त ओपन-सोर्स मॉडलों में स्थानांतरित करता है, जो बड़े भाषा मॉडलों को ब्लैक बॉक्स के रूप में उपयोग करने की लागत और निरंतरता की सीमाओं को संबोधित करते हुए, क्रॉस-लैंग्वेज कोड क्लोन डिटेक्शन के लिए उनकी विश्वसनीयता और प्रदर्शन को महत्वपूर्ण रूप से बढ़ाता है।

Mohamad Khajezade, Fatemeh H. Fard, Mohamed Sami Shehata2026-05-06
💻 computer science

Human-in-the-Loop Uncertainty Analysis in Self-Adaptive Robots Using LLMs

यह शोधपत्र RoboULM को प्रस्तुत करता है, जो एक मानव-इन-द-लूप पद्धति और उपकरण है जो डिज़ाइन चरण के दौरान स्व-अनुकूली रोबोटों में अनिश्चितताओं को व्यवस्थित रूप से पहचानने, विश्लेषण करने और कम करने में मदद करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जैसा कि चार उपयोग के मामलों में औद्योगिक पेशेवरों से प्राप्त सकारात्मक प्रतिक्रिया द्वारा सत्यापित किया गया है।

Hassan Sartaj, Jalil Boudjadar, Mirgita Frasheri, Shaukat Ali, Peter Gorm Larsen2026-05-06✓ Author reviewed
💻 computer science

ARIS: Autonomous Research via Adversarial Multi-Agent Collaboration

यह शोध पत्र ARIS को प्रस्तुत करता है, जो एक ओपन-सोर्स ऑटोनॉमस रिसर्च हार्नेस है जो एक क्रॉस-मॉडल एडवरसेरियल कोलैबोरेशन फ्रेमवर्क के माध्यम से लॉन्ग-होराइजन वर्कफ़्लो में असमर्थित दावों के जोखिम को कम करता है, जहाँ एक एक्सेक्यूटर मॉडल प्रगति को संचालित करता है और एक विशिष्ट रिव्यूअर मॉडल एक मल्टी-लेयर्ड एश्योरेंस सिस्टम के माध्यम से साक्ष्य, दावों और परिणामों का कड़ाई से ऑडिट करता है।

Ruofeng Yang, Yongcan Li, Shuai Li2026-05-06
💻 computer science

ARISE: A Repository-level Graph Representation and Toolset for Agentic Fault Localization and Program Repair

ARISE एक रिपॉजिटरी-स्तरीय फ्रेमवर्क है जो इंट्रा-प्रोसीजरल डेटा-फ्लो एडजेस (intra-procedural data-flow edges) के साथ एक मल्टी-ग्रैनुलैरिटी प्रोग्राम ग्राफ और एक क्वेरेबल स्लाइसिंग API पेश करके फॉल्ट लोकलाइजेशन और प्रोग्राम रिपेयर के लिए LLM-आधारित एजेंटों को उन्नत करता है, जिससे SWE-bench Lite बेंचमार्क पर लोकलाइजेशन सटीकता और रिपेयर सफलता दर में महत्वपूर्ण सुधार होता है।

Shahd Seddik, Fatemeh Fard2026-05-06
💻 computer science

Learning Correct Behavior from Examples: Validating Sequential Execution in Autonomous Agents

यह शोध पत्र एक नवीन एल्गोरिदम प्रस्तुत करता है जो केवल 2-10 निष्पादन ट्रेसेस (execution traces) से सामान्यीकृत ग्राउंड ट्रुथ मॉडल सीखकर स्वायत्त एजेंटों के अनुक्रमिक व्यवहार को मान्य करता है, जो डोमिनेटर विश्लेषण और मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स का लाभ उठाकर विविध डोमेन में बग डिटेक्शन और व्याख्या योग्य सत्यापन में उच्च सटीकता प्राप्त करता है।

Reshabh K Sharma, Gaurav Mittal, Yu Hu2026-05-06
💻 computer science

A Validated Prompt Bank for Malicious Code Generation: Separating Executable Weapons from Security Knowledge in 1,554 Consensus-Labeled Prompts

यह शोध पत्र एक मान्य 1,554-प्रॉम्प्ट "CODE" बैंक और एक सर्वसम्मति-लेबल वाली वर्गीकरण रूपरेखा प्रस्तुत करता है जो मौजूदा भाषा मॉडल सुरक्षा बेंचमार्क में निहित संलयन संबंधी समस्याओं को संबोधित करने के लिए निष्पादन योग्य दुर्भावनापूर्ण सॉफ़्टवेयर अनुरोधों को हानिकारक सुरक्षा ज्ञान प्रश्नों से कठोरता से अलग करता है।

Richard J. Young, Gregory D. Moody2026-05-06
💻 computer science

TeamUp: Semantic Project Matching and Team Formation for Learning at Scale

यह शोधपत्र TeamUp को प्रस्तुत करता है, जो एक हल्का, एम्बेडिंग-आधारित सिस्टम है जो संज्ञानात्मक रूप से विविध छात्र टीमों को स्वचालित रूप से बनाने और उन्हें उपयुक्त रूप से चुनौतीपूर्ण परियोजनाओं के साथ संरेखित करने के लिए सिमेंटिक मैचिंग और हाइब्रिड रैंकिंग एल्गोरिदम का लाभ उठाता है, जिससे बड़े पैमाने पर प्रोजेक्ट-आधारित पाठ्यक्रमों में मैच की गुणवत्ता, समानता और सीखने के परिणामों में महत्वपूर्ण सुधार होता है।

Dhruv Gulwani, Basem Suleiman, Aditya Joshi, Sonit Singh2026-05-06
💻 computer science

Exploring Sustainability in Scientific Software through Code Quality & Test Coverage Metrics

यह अध्ययन वैज्ञानिक ओपन-सोर्स सॉफ़्टवेयर में कोड गुणवत्ता और टेस्ट कवरेज मेट्रिक्स का विश्लेषण करता है ताकि यह प्रदर्शित किया जा सके कि टिकाऊ प्रोजेक्ट उच्च, अधिक सुसंगत टेस्ट कवरेज और मजबूत कोड-टेस्ट सहसंबंध प्रदर्शित करते हैं, जबकि यह भी रेखांकित करता है कि कम समग्र टेस्टेबिलिटी अक्सर उच्च जटिलता और कपलिंग द्वारा संचालित होती है।

Sheikh Md. Mushfiqur Rahman, Gregory R. Watson, Nasir U. Eisty2026-05-06
💻 computer science

Operationalizing Software Engineering Theories for Practical Validation

यह शोध पत्र अमूर्त सॉफ्टवेयर इंजीनियरिंग अवधारणाओं को मापने योग्य चरों और परीक्षण योग्य परिकल्पनाओं में परिचालन योग्य बनाने के लिए एक व्यवस्थित, साक्ष्य-आधारित प्रक्रिया प्रस्तावित करता है, जिससे सैद्धांतिक ढांचों और व्यावहारिक अनुभवजन्य सत्यापन के बीच के अंतर को पाटा जा सके।

Isaque Alves, Fabio Kon, Jessica Diaz, Carla Rocha2026-05-06