💻 computer science

Using LLMs to Evaluate Architecture Documents: Results from a Digital Marketplace Environment

यह शोध पत्र एक डिजिटल मार्केटप्लेस प्रोजेक्ट के भीतर सॉफ्टवेयर आर्किटेक्चर दस्तावेजों का मूल्यांकन करने के लिए लार्ज लैंग्वेज मॉडल्स (LLMs) के उपयोग की प्रभावकारिता की जांच करता है, जिसमें यह पाया गया है कि हालांकि LLMs आशाजनक दिखते हैं, लेकिन मानव विशेषज्ञ मूल्यांकनों के साथ उनकी निरंतरता काफी हद तक आर्किटेक्चर आर्टिफैक्ट्स की प्रारंभिक गुणवत्ता पर निर्भर करती है।

Frank Elberzhager, Matthias Gerbershagen, Joshua Ginkel2026-01-28
💻 computer science

Future of Software Engineering Research: The SIGSOFT Perspective

सर्वेक्षण डेटा का उपयोग करते हुए, यह शोध पत्र SIGSOFT के लिए बढ़ते खर्चों और पुराने कॉन्फ्रेंस प्रारूपों को संबोधित करने हेतु ठोस कार्य प्रस्तावित करता है, जिससे सॉफ्टवेयर इंजीनियरिंग समुदाय की सफलता के लिए आवश्यक समावेशिता और वैश्विक विविधता को संरक्षित किया जा सके।

Massimiliano Di Penta, Kelly Blincoe, Marsha Chechik, Claire Le Goues, David Lo, Emerson Murphy-Hill, Thomas Zimmermann2026-01-28
🤖 AI

Veri-Sure: A Contract-Aware Multi-Agent Framework with Temporal Tracing and Formal Verification for Correct RTL Code Generation

वेरी-श्योर (Veri-Sure) एक कॉन्ट्रैक्ट-अवेयर मल्टी-एजेंट फ्रेमवर्क है जो डिज़ाइन कॉन्ट्रैक्ट्स के माध्यम से एजेंट इंटेंट को संरेखित करके, स्टैटिक डिपेंडेंसी स्लाइसिंग के माध्यम से सटीक स्थानीयकृत मरम्मत (localized repairs) करके, और ट्रेस-ड्रिवन टेम्पोरल एनालिसिस एवं फॉर्मल वेरिफिकेशन के हाइब्रिड पाइपलाइन के माध्यम से आउटपुट को मान्य करके सिलिकॉन-ग्रेड आरटीएल (RTL) शुद्धता सुनिश्चित करता है, जिसका मूल्यांकन नए पेश किए गए इंडस्ट्रियल-ग्रेड VerilogEval-v2-EXT बेंचमार्क पर किया गया है।

Jiale Liu, Taiyu Zhou, Tianqi Jiang2026-01-28
🤖 AI

Reimagining Peer Review Process Through Multi-Agent Mechanism Design

यह स्थिति पत्र (position paper) सॉफ्टवेयर इंजीनियरिंग पीयर रिव्यू प्रक्रिया की प्रणालीगत विफलताओं को संबोधित करने के लिए समुदाय को एक स्टोकेस्टिक मल्टी-एजेंट सिस्टम के रूप में मॉडल करने और क्रेडिट-आधारित अर्थव्यवस्था, अनुकूलित समीक्षक असाइनमेंट और हाइब्रिड सत्यापन सहित प्रोत्साहन-संगत प्रोटोकॉल डिजाइन करने के लिए मल्टी-एजेंट रीइन्फोर्समेंट लर्निंग लागू करने का प्रस्ताव करता है।

Ahmad Farooq, Kamran Iqbal2026-01-28
💻 computer science

Assessing Task-based Chatbots: Snapshot and Curated Datasets for Dialogflow

यह शोध पत्र TOFU-D और COD को प्रस्तुत करता है, जो क्रमशः 1,788 और 185 Dialogflow चैटबॉट्स से बने दो डेटासेट हैं, ताकि अनुभवजन्य अनुसंधान के लिए क्यूरेटेड संसाधनों की कमी को दूर किया जा सके, जबकि प्रारंभिक विश्लेषण परीक्षण कवरेज में महत्वपूर्ण अंतराल और बार-बार होने वाली सुरक्षा कमजोरियों को प्रकट करता है जो चैटबॉट गुणवत्ता और सुरक्षा पर व्यवस्थित बहु-प्लेटफ़ॉर्म अध्ययनों की आवश्यकता को रेखांकित करते हैं।

Elena Masserini, Diego Clerissi, Daniela Micucci, Leonardo Mariani2026-01-28
🤖 AI

MoSE: Hierarchical Self-Distillation Enhances Early Layer Embeddings

यह शोध पत्र MoSE को प्रस्तुत करता है, जो एक 1-बिलियन-पैरामीटर वाला मल्टी-एग्जिट एनकोडर है जो शुरुआती-परत एम्बेडिंग्स को बेहतर बनाने के लिए पदानुक्रमित स्व-डिस्टिलेशन (hierarchical self-distillation) और रिपॉजिटरी-स्तरीय प्रासंगिक हानि (repository-level contextual loss) का उपयोग करता है, जिससे कोड रिट्रीवल और वर्गीकरण कार्यों के लिए लचीला और लागत प्रभावी परिनियोजन सक्षम होता है।

Andrea Gurioli, Federico Pennino, João Monteiro, Maurizio Gabbrielli2026-01-27
💻 computer science

Scaling Automated Database System Testing

यह शोध पत्र SQLancer++ को प्रस्तुत करता है, जो एक लर्निंग-आधारित SQL जनरेटर का उपयोग करके मौजूदा स्वचालित डेटाबेस परीक्षण की स्केलेबिलिटी सीमाओं को पार करने वाला एक एडेप्टिव प्लेटफॉर्म है, ताकि 18 विविध DBMSs में सैकड़ों लॉजिक बग्स को कुशलतापूर्वक खोजा और सुधारा जा सके।

Suyang Zhong, Manuel Rigger2026-01-27
💻 computer science

An object-centric core metamodel for IoT-enhanced event logs

यह शोध पत्र एक कोर ऑब्जेक्ट-सेंट्रिक मेटामॉडल प्रस्तावित करके IoT-प्रोसेस डेटा एकीकरण में विखंडन को संबोधित करता है जो प्रोसेस माइनिंग में डेटा साझाकरण और सहयोग को सुगम बनाने के लिए मौजूदा दृष्टिकोणों को संश्लेषित करता है, जिसे विभिन्न उपयोग के मामलों में एक पायथन कार्यान्वयन के माध्यम से मान्य किया गया है।

Yannis Bertrand, Christian Imenkamp, Lukas Malburg, Matthias Ehrendorfer, Marco Franceschetti, Joscha Grüger, Francesco (…)2026-01-27
💻 computer science

On the synchronization between Hugging Face pre-trained language models and their upstream GitHub repository

325 प्री-ट्रेन्ड लैंग्वेज मॉडल परिवारों का यह मिश्रित-विधि अध्ययन उनके अपस्ट्रीम गिटहब (GitHub) विकास और डाउनस्ट्रीम हगिंग फेस (Hugging Face) वितरण के बीच महत्वपूर्ण संरचनात्मक विच्छेद को प्रकट करता है, जो आठ विशिष्ट सिंक्रोनाइज़ेशन पैटर्न की पहचान करता है जो अक्सर एंड-यूजर्स के लिए असंगत, पुराने या अपूर्ण मॉडल रिलीज का कारण बनते हैं।

Adekunle Ajibode, Abdul Ali Bangash, Oussama Ben Sghaier, Bram Adams, Ahmed E. Hassan2026-01-27
💻 computer science

E-Test: E'er-Improving Test Suites

यह शोध पत्र E-Test प्रस्तुत करता है, जो प्रोडक्शन डेटा से अनटेस्टेड निष्पादन परिदृश्यों (untested execution scenarios) की पहचान करने और नए टेस्ट केस स्वचालित रूप से उत्पन्न करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जो टेस्ट सुइट की कवरेज और विश्वसनीयता को बढ़ाने में अत्याधुनिक तरीकों से काफी बेहतर प्रदर्शन करता है।

Ketai Qiu, Luca Di Grazia, Leonardo Mariani, Mauro Pezzè2026-01-27