🤖 AI

Adoption of Generative Artificial Intelligence in the German Software Engineering Industry: An Empirical Study

यह मिश्रित-पद्धति वाला अध्ययन जर्मन सॉफ्टवेयर इंजीनियरों के बीच जनरेटिव एआई उपकरणों को अपनाने की गतिशीलता की जांच करता है, जो यह प्रकट करता है कि अनुभव का स्तर और संगठनात्मक आकार कथित लाभों और उपयोग की तीव्रता को महत्वपूर्ण रूप से प्रभावित करते हैं, जबकि सीमित प्रोजेक्ट संदर्भ जागरूकता प्रभावी कार्यान्वयन के लिए प्राथमिक बाधा बनी हुई है।

Ludwig Felder, Tobias Eisenreich, Mahsa Fischer, Stefan Wagner, Chunyang Chen2026-06-10
💬 NLP

ProbeLLM: Automating Principled Diagnosis of LLM Failures

ProbeLLM एक बेंचमार्क-अज्ञेय (benchmark-agnostic) स्वचालित ढांचा है जो पदानुक्रमित मोंटे कार्लो ट्री सर्च (hierarchical Monte Carlo Tree Search) और टूल-संवर्धित सत्यापन (tool-augmented verification) का उपयोग करके LLM विफलताओं को व्यवस्थित रूप से व्याख्या योग्य विफलता मोडों में खोजने, परिष्कृत करने और समेकित करने के लिए नियोजित करता है, जिससे मूल्यांकन अलग-थलग मामलों के पता लगाने से सिद्धांतपूर्ण कमजोरी की खोज की ओर स्थानांतरित हो जाता है।

Yue Huang, Zhengzhe Jiang, Yuchen Ma, Yu Jiang, Xiangqi Wang, Yujun Zhou, Yuexing Hao, Kehan Guo, Pin-Yu Chen, Stefan Fe (…)2026-06-10
🤖 AI

What makes a harness a harness: necessary and sufficient conditions for an agent harness

यह शोध पत्र जनरेटिव एआई में "एजेंट हार्नेस" (agent harness) के ढीले और बहुअर्थी उपयोग को एक वैचारिक वंशावली और आवश्यक एवं पर्याप्त शर्तों के साथ एक परिचालन परिभाषा प्रदान करके संबोधित करता है, ताकि एजेंट हार्नेस को फ्रेमवर्क, SDK और इवैल्यूएटर्स जैसी संबंधित अवधारणाओं से सुसंगत रूप से अलग किया जा सके, जिससे इंजीनियरिंग अभ्यास और वैज्ञानिक तुलना के लिए एक साझा शब्दावली स्थापित की जा सके।

Sanderson Oliveira de Macedo2026-06-10
💻 computer science

TestMap: Evidence Infrastructure for Foundation-Model-Assisted Test Generation

यह शोधपत्र TestMap प्रस्तुत करता है, जो C#/.NET के लिए एक ओपन-सोर्स इंफ्रास्ट्रक्चर है जो विभिन्न मॉडलों और रणनीतियों के माध्यम से जनरेट किए गए परीक्षणों (tests) के साक्ष्य की गुणवत्ता को व्यवस्थित रूप से ट्रैक, माप और तुलना करने के लिए विविध सत्यापन उपकरणों को एकीकृत करके, फाउंडेशन-मॉडल-सहायता प्राप्त परीक्षण जनरेशन के एंड-टू-एंड लाइफसाइकिल को स्वचालित करता है।

Hunter Leary, Luke Hanuska, Chris Brown2026-06-10
💻 computer science

The Linux IOCTL Census: A Source-Derived Database of the Linux Kernel Control-Code Surface

यह शोध पत्र लिनक्स IOCTL जनगणना (Linux IOCTL Census) को प्रस्तुत करता है, जो 878 मॉड्यूल का विश्लेषण करके डिस्पैच पॉइंट्स, कमांड कोड और सुरक्षा गेट्स की पहचान करके लिनक्स कर्नेल के ioctl कमांड सरफेस को व्यवस्थित रूप से सूचीबद्ध करने वाला एक स्रोत-व्युत्पन्न डेटाबेस है, जिससे क्रॉस-प्लेटफॉर्म भेद्यता विश्लेषण और थ्रेट मॉडलिंग सक्षम होती है।

Michael J. Bommarito2026-06-10
💻 computer science

From Awareness to Action: How Developers Engage with Accessibility Innovation in LLM-Assisted Development

यह शोध पत्र तर्क देता है कि कॉर्पोरेट LLM-सहायता प्राप्त विकास में सुलभता (accessibility), जब संगठन विकलांग व्यक्तियों के नेतृत्व वाले सहभागी दृष्टिकोणों को अपनाते हैं, तो केवल एक अनुपालन आवश्यकता से विकसित होकर नवाचार और सांस्कृतिक परिवर्तन के चालक में बदल सकती है।

Thayssa Águila da Rocha, Luciane Silva, Ana Duarte, Marcelle Pereira Mota, Gustavo Pinto2026-06-10
💻 computer science

Communication Skills in Software Engineering: A Multivocal Review

यह बहुस्वरतापूर्ण साहित्य समीक्षा खंडित शैक्षणिक और ग्रे लिटरेचर (gray literature) को इस प्रकार संश्लेषित करती है कि जहाँ दोनों स्रोत सॉफ्टवेयर इंजीनियरिंग में एक मुख्य सक्षमता के रूप में संचार पर सहमत हैं, वहीं वे अपने ध्यान के क्षेत्र में भिन्न हैं, जिसमें अकादमिक जगत वैचारिक अवधारणा और अनुभवजन्य साक्ष्य को प्राथमिकता देता है जबकि उद्योग साहित्य व्यावहारिक अनुप्रयोगों और उभरते अभ्यासों पर बल देता है।

Dannilo Rabelo, Deisy Peres, Emmanuel Dias, Thayssa Rocha, Enne Rebeca de Freitas, Kiev Gama, Gustavo Pinto2026-06-10
💻 computer science

Beyond Coverage and Kill Scores: Empirically Measuring Test Suite Behavioural Gaps

यह शोध पत्र दस्तावेज़ों और कोड से निकाले गए अपेक्षित व्यवहारों की वास्तविक परीक्षण कवरेज के विरुद्ध तुलना करके "व्यवहार संबंधी अंतराल" (behavioural gaps) को मापने के लिए एक स्वचालित दृष्टिकोण प्रस्तुत करता है, जिससे यह प्रकट होता है कि अत्यधिक कवर किए गए कोड में भी अपेक्षित व्यवहारों का एक महत्वपूर्ण हिस्सा अप्रशिक्षित रह जाता है और ये अंतराल लाइन कवरेज या म्यूटेशन स्कोर जैसे पारंपरिक संरचनात्मक मेट्रिक्स द्वारा पता नहीं लगाए जाते हैं।

Partha Protim Paul, Reid Holmes2026-06-10
💻 computer science

MASTOR: A Multi-Agent Approach to Semantic Test Oracle Generation for RESTful APIs

MASTOR एक मल्टी-एजेंट फ्रेमवर्क है जो RESTful APIs के लिए सिमेंटिक टेस्ट ओरेकल (semantic test oracles) उत्पन्न करने के लिए सोर्स कोड विश्लेषण और एक चैलेंजर-एजेंट समीक्षा प्रक्रिया का लाभ उठाता है, जो बिजनेस लॉजिक उल्लंघनों का पता लगाने में मौजूदा बेसलाइन से काफी बेहतर प्रदर्शन करता है और 75.4% म्यूटेशन स्कोर प्राप्त करता है।

Sida Deng, Rubing Huang, Zhenzhen Yang, Man Zhang, Xuan Xie, Rongcun Wang2026-06-10
💻 computer science

Modular2Simple: A Tool for Modular Scenario Creation Based on the OpenSCENARIO Format

Modular2Simple एक ऐसा टूल है जो सरल OpenSCENARIO मॉड्यूल्स के लचीले संयोजन को सक्षम करके जटिल स्वायत्त ड्राइविंग परिदृश्यों के निर्माण को सुव्यवस्थित करता है, जिससे विकास के समय, कोड की जटिलता और प्रयास को कम करने के साथ-साथ परिदृश्यों के पुन: उपयोग और CARLA जैसे सिम्युलेटर के साथ एकीकरण को बढ़ावा मिलता है।

Nikolai Khriapov, Mohamed Taha Drif, Renjue Li, Cas Widdershoven2026-06-10