🤖 AI

LLMs for Qualitative Data Analysis Fail on Security-specificComments in Human Experiments

यह शोध पत्र मानव प्रयोगों में सुरक्षा-विशिष्ट टिप्पणियों के विषयगत विश्लेषण (thematic analysis) को स्वचालित करने की बड़े भाषा मॉडलों (large language models) की क्षमता का मूल्यांकन करता है, जिसमें यह पाया गया है कि हालांकि विस्तृत कोडबुक प्रदर्शन में सुधार करती हैं, फिर भी वर्तमान मॉडलों में इस जटिल कार्य के लिए मानव एनोटेटरों को प्रतिस्थापित करने की विश्वसनीयता का अभाव है।

Maria Camporese, Fabio Massacci, Yuanjun Gong2026-04-14
🤖 AI

Resilient Write: A Six-Layer Durable Write Surface for LLM Coding Agents

यह शोध पत्र 'रेज़िलिएंट राइट' (Resilient Write) का परिचय देता है, जो एक ओपन-सोर्स मॉडल कॉन्टेक्स्ट प्रोटोकॉल (MCP) सर्वर है जिसमें छह-परतीय ड्यूरेबल राइट सरफेस (six-layer durable write surface) है जो एटॉमिक ट्रांजेक्शन और स्ट्रक्चर्ड एरर रिपोर्टिंग जैसे तंत्रों के माध्यम से LLM कोडिंग एजेंटों में होने वाली सामान्य फ़ाइल-राइटिंग विफलताओं को कम करता है, जिसके परिणामस्वरूप रिकवरी समय में 5 गुना की कमी और सेल्फ-करेक्शन दरों में 13 गुना सुधार होता है।

Justice Owusu Agyemang, Jerry John Kponyo, Elliot Amponsah, Godfred Manu Addo Boakye, Kwame Opuni-Boachie Obour Agyekum2026-04-14
🤖 AI

Compliant But Unsatisfactory: The Gap Between Auditing Standards and Practices for Probabilistic Genotyping Software

यह शोधपत्र संभाव्य जीनोटाइपिंग सॉफ्टवेयर (probabilistic genotyping software) के लिए ASB 018 ऑडिटिंग मानक की आलोचना करता है, और यह तर्क देता है कि इसका अस्पष्ट डिज़ाइन अनुपालन और प्रभावशीलता के बीच एक अंतराल पैदा करता है, जिससे ऑडिट संतोषजनक दिखाई दे सकते हैं जबकि वे अमेरिकी आपराधिक कानूनी प्रणाली में सॉफ्टवेयर के उपयोग पर आवश्यक प्रतिबंध स्थापित करने में विफल रहते हैं।

Angela Jin, Alexander Asemota, Dan E. Krane, Nathaniel D. Adams, Rediet Abebe2026-04-14
🤖 AI

Taking a Pulse on How Generative AI is Reshaping the Software Engineering Research Landscape

यह शोध पत्र 457 सॉफ्टवेयर इंजीनियरिंग शोधकर्ताओं के एक बड़े पैमाने के सर्वेक्षण को प्रस्तुत करता है जो अनुसंधान गतिविधियों में जनरेटिव एआई (Generative AI) के व्यापक लेकिन असमान उपयोग को रेखांकित करता है, जो लेखन कार्यों में इसकी एकाग्रता, विश्वास और पूर्वाग्रह संबंधी चिंताओं के साथ कथित उत्पादकता लाभों, और स्पष्ट शासन एवं शमन रणनीतियों की तत्काल आवश्यकता पर प्रकाश डालता है।

Bianca Trinkenreich, Fabio Calefato, Kelly Blincoe, Viggo Tellefsen Wivestad, Antonio Pedro Santos Alves, Júlia Condé Ar (…)2026-04-14
🤖 AI

Designing Adaptive Digital Nudging Systems with LLM-Driven Reasoning

यह शोध पत्र एक LLM-संचालित सॉफ्टवेयर आर्किटेक्चर का प्रस्ताव करता है जो 68 नजिंग (nudging) रणनीतियों और 11 गुणवत्ता गुणों को संरचनात्मक गार्डरेल्स में अनुवादित करके व्यवहार विज्ञान और नैतिक अनुपालन के बीच सेतु बनाता है, जिसे विशेषज्ञ समीक्षा और आवासीय ऊर्जा स्थिरता के प्रूफ-ऑफ-कॉन्सेप्ट के माध्यम से मान्य किया गया है जो उच्च हस्तक्षेप गुणवत्ता और सकारात्मक भावनात्मक प्रभाव प्रदर्शित करता है।

Tiziano Santilli, Mina Alipour, Mahyar Tourchi Moghaddam2026-04-14
💬 NLP

DuET: Dual Execution for Test Output Prediction with Generated Code and Pseudocode

यह शोध पत्र DuET को प्रस्तुत करता है, जो एक दोहरा-निष्पादन ढांचा (dual-execution framework) है जो कार्यात्मक बहुमत मतदान (functional majority voting) के माध्यम से प्रत्यक्ष कोड निष्पादन और LLM-आधारित स्यूडोकोड तर्क (pseudocode reasoning) को जोड़ता है ताकि टेस्ट आउटपुट भविष्यवाणी की विश्वसनीयता में महत्वपूर्ण सुधार किया जा सके और LiveCodeBench पर अत्याधुनिक प्रदर्शन प्राप्त किया जा सके।

Hojae Han, Jaejin Kim, Seung-won Hwang, Yu Jin Kim, Moontae Lee2026-04-14
🤖 AI

FM-Agent: Scaling Formal Methods to Large Systems via LLM-Based Hoare-Style Reasoning

FM-Agent एक नवीन फ्रेमवर्क है जो प्राकृतिक भाषा में कॉलर की अपेक्षाओं से फंक्शन-स्तर के विनिर्देश (specifications) उत्पन्न करके, बड़े पैमाने के सिस्टम के लिए कंपोजिशनल रीजनिंग को स्वचालित करने हेतु लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जिससे जटिल कोडबेस के भीतर कुछ ही दिनों के भीतर सैकड़ों महत्वपूर्ण बग्स की खोज संभव हो पाती है।

Haoran Ding, Zhaoguo Wang, Haibo Chen2026-04-14
🤖 AI

Context Kubernetes: Declarative Orchestration of Enterprise Knowledge for Agentic AI Systems

यह शोध पत्र कॉन्टेक्स्ट कुबेरनेट्स (Context Kubernetes) को प्रस्तुत करता है, जो एक डिक्लेरेटिव ऑर्केस्ट्रेशन आर्किटेक्चर है जो एजेंटिक एआई सिस्टम के लिए एंटरप्राइज नॉलेज को प्रबंधित करने हेतु कुबेरनेट्स जैसे सिद्धांतों को लागू करता है, जो डेटा लीक और मतिभ्रम (hallucinations) को रोकने के लिए सख्त अनुमति सीमाओं, रियल-टाइम फ्रेशनेस और गवर्नेंस को सुनिश्चित करते हुए मौजूदा एंटरप्राइज प्लेटफॉर्म्स से बेहतर प्रदर्शन करता है।

Charafeddine Mouzouni2026-04-14
⚡ electrical engineering

ACT: Automated CPS Testing for Open-Source Robotic Platforms

यह शोध पत्र ऑटोमेटेड सीपीएस टेस्टिंग (ACT) का प्रस्ताव करता है, जो मल्टी-कंट्रीब्यूटर वातावरण में सुदृढ़ परीक्षण की कमी को दूर करने के लिए रोबोटिक प्लेटफॉर्म और गिटहब (GitHub) इंफ्रास्ट्रक्चर के साथ ओपन-सोर्स साइबर-फिजिकल सिस्टम सॉफ्टवेयर के स्वचालित, निरंतर परीक्षण को एकीकृत करता है।

Aditya A. Krishnan, Donghoon Kim, Hokeun Kim2026-04-14
🔬 physics

Design for a Digital Twin in Clinical Patient Care

यह शोध पत्र एक सामान्य, मॉड्यूलर डिजिटल ट्विन डिज़ाइन प्रस्तुत करता है जो ज्ञान ग्राफ (knowledge graphs) और एंसेम्बल लर्निंग (ensemble learning) को एकीकृत करता है ताकि रोगी की संपूर्ण नैदानिक यात्रा का मॉडल बनाया जा सके, जिससे व्यक्तिगत नैदानिक निर्णय लेने के लिए भविष्य कहनेवाला, व्याख्यात्मक और स्पष्ट समर्थन प्रदान किया जा सके।

Anna-Katharina Nitschke (Physikalisches Institut, Universität Heidelberg, Heidelberg, Germany), Carlos Brandl (Physikali (…)2026-04-13