💻 computer science

Leveraging Language Models for Log Statement Generation in Multilingual Scenarios: How Far Are We?

यह शोध पत्र पांच प्रोग्रामिंग भाषाओं में अत्याधुनिक लॉग जनरेशन दृष्टिकोणों और लार्ज लैंग्वेज मॉडल्स का मूल्यांकन करने के लिए एक बड़े पैमाने के बहुभाषी बेंचमार्क को प्रस्तुत करता है, जो यह प्रकट करता है कि हालांकि UniLog समग्र रूप से सर्वश्रेष्ठ प्रदर्शन करता है, फिर भी महत्वपूर्ण भाषा-विशिष्ट चुनौतियां मौजूद हैं जिनके लिए केवल मॉडल के आकार या डेटा की मात्रा को बढ़ाने के बजाय विशेष समाधानों की आवश्यकता है।

Kazuki Kusama, Honglin Shu, Masanari Kondo, Yasutaka Kamei2026-05-26
🤖 AI

KYA: A Framework-Agnostic Trust Layer for Autonomous Systems with Verifiable Provenance and Hierarchical Policy Composition

KYA स्वायत्त प्रणालियों (autonomous systems) के लिए एक ओपन-सोर्स, फ्रेमवर्क-अज्ञेय (framework-agnostic) ट्रस्ट लेयर है जो एजेंट ड्रिफ्ट, लीक्स और एडवरसेरियल हमलों का पता लगाने के लिए पांच मुख्य प्रिमिटिव्स—जिसमें एक सुरक्षित फोर-गेट अप्लाई पाइपलाइन, पदानुक्रमित नीति संरचना (hierarchical policy composition), और एकीकृत ट्रस्ट स्कोरिंग शामिल है—का उपयोग करता है, जबकि सब-मिलीसेकंड लेटेंसी और उच्च थ्रूपुट को बनाए रखता है।

Kolawole Quadri2026-05-26
💻 computer science

Temporal Modeling of Change History for Black-Box Test Suite Minimization

यह शोध पत्र टेम्पोरल रिस्क-ड्रिवन टेस्ट सुइट मिनिमाइजेशन (TRTM) का प्रस्ताव करता है, जो एक ब्लैक-बॉक्स दृष्टिकोण है जो जोखिम स्कोर की गणना करने के लिए हाल के कोड संशोधनों को अधिक भार देकर टेस्ट सुइट न्यूनीकरण में सुधार करता है, जिससे मौजूदा अत्याधुनिक विधियों की तुलना में उच्च दोष पहचान दर और सटीकता प्राप्त होती है।

Kamruzzaman Asif, Md. Siam, Kazi Sakib2026-05-26
🤖 AI

A Tertiary Review of Large Language Model-Based Code Generating Tasks: Trends, Challenges, and Future Directions

यह तृतीयक समीक्षा लार्ज लैंग्वेज मॉडल-आधारित कोड जनरेशन पर 30 माध्यमिक अध्ययनों का संश्लेषण करती है ताकि एक तेजी से बढ़ते लेकिन असमान रूप से मूल्यांकित क्षेत्र को प्रकट किया जा सके जहाँ मजबूत बेंचमार्क प्रदर्शन, वास्तविक दुनिया के सामान्यीकरण, सुदृढ़ता, दक्षता और सामाजिक-तकनीकी एकीकरण में महत्वपूर्ण चुनौतियों के विपरीत खड़ा है।

Muslim Chochlov, Michael English, Jim Buckley2026-05-26
🤖 AI

Meta-Engineering Harnesses for AI-Native Software Production: A Contract-Driven Adversarial Verification Architecture with Early Deployment Report

यह शोध पत्र एक मेटा-इंजीनियरिंग हार्नेस प्रस्तुत करता है जो आवश्यकताओं को स्पष्ट अनुबंधों में बदलकर, प्रतिकूल सत्यापन (adversarial verification) के साथ भूमिका-विशिष्ट एजेंटों का उपयोग करके, और एक आउटर-लूप कैलिब्रेशन सिस्टम को नियोजित करके, विश्वसनीय, ऑडिट करने योग्य और निरंतर सुधारने योग्य एआई-नेटिव सॉफ्टवेयर उत्पादन को सक्षम बनाता है, जैसा कि छोटे सेवा फर्मों के लिए विकसित तकनीकी बुनियादी ढांचे का प्रबंधन करने वाले एक प्रारंभिक परिनियोजन के माध्यम से प्रदर्शित किया गया है।

Satadru Sengupta, Tamunokorite Briggs, Ivan Myshakivskyi2026-05-26
💻 computer science

CelerLog: Fast Log Parsing via Dynamic Routing

CelerLog एक तेज़ और प्रभावी लॉग पार्सर है जो लॉग्स को सांख्यिकीय (statistical) और अर्थ संबंधी (semantic) समूहों में वर्गीकृत करने के लिए एक गतिशील रूटिंग तंत्र का उपयोग करता है, जो दोहराव वाले अधिकांश पैटर्न को कुशल सांख्यिकीय विधियों के साथ संसाधित करता है जबकि जटिल मामलों के लिए LLM इन्फरेंस को आरक्षित रखता है, जिससे मौजूदा अत्याधुनिक दृष्टिकोणों की तुलना में काफी कम विलंबता (latency) और लागत के साथ बेहतर प्रदर्शन प्राप्त होता है।

Shiwen Shan, Yintong Huo, Minxing Wang, Zhiying Wu, Yuxin Su, Zibin Zheng2026-05-26
💬 NLP

When Gradients Collide: Failure Modes of Multi-Objective Prompt Optimization for LLM Judges

यह शोध पत्र दो प्राथमिक विफलता मोडों—ऑप्टिमाइज़ेशन-टाइम ग्रेडिएंट डाइल्यूशन (optimization-time gradient dilution) और इन्फरेंस-टाइम इंस्ट्रक्शन इंटरफेरेंस (inference-time instruction interference)—की पहचान करता है, जो LLM जजों के लिए मल्टी-ऑब्जेक्टिव प्रॉम्प्ट ऑप्टिमाइज़ेशन में बाधा डालते हैं, यह प्रदर्शित करते हुए कि मौजूदा टेक्स्टुअल ग्रेडिएंट विधियाँ अक्सर कई मानदंडों को एक साथ संभालते समय प्रारंभिक प्रॉम्प्ट्स से बेहतर सुधार करने में विफल रहती हैं।

Parth Darshan, Abhishek Divekar2026-05-26
🤖 AI

Beyond Summaries: Structure-Aware Labeling of Code Changes with Large Language Models

यह शोध पत्र कोड परिवर्तनों के संरचना-जागरूक, वर्गीकरण-आधारित लेबलिंग को करने के लिए लार्ज लैंग्वेज मॉडल्स का उपयोग करते हुए एक दो-चरणीय, फ्यू-शॉट प्रॉम्प्टिंग पाइपलाइन प्रस्तुत करता है, जो उच्च परिशुद्धता और रिकॉल प्राप्त करते हुए कोड समीक्षा दक्षता में सुधार के लिए पारंपरिक स्टैटिक एनालिसिस के एक लचीले, भाषा-अज्ञेय विकल्प के रूप में कार्य करता है।

Bar Weiss, Antonio Abu-Nassar, Adi Sosnovich, Karen Yorav2026-05-26
💻 computer science

Demonstrators for Industrial Cyber-Physical System Research: A Requirements Hierarchy Driven by Software-Intensive Design

यह शोध पत्र सॉफ्टवेयर-गहन औद्योगिक साइबर-भौतिक प्रणालियों में प्रदर्शनकर्ता (डेमोंस्ट्रेटर) आवश्यकताओं को परिभाषित करने के लिए एक पांच-स्तरीय पदानुक्रमित ढांचे का प्रस्ताव करता है ताकि अस्पष्ट निष्कर्षण प्रथाओं के कारण परियोजना लक्ष्यों और प्राप्त परिणामों के बीच होने वाले सामान्य बेमेल को संबोधित किया जा सके।

Uraz Odyurt, Richard Loendersloot, Tiedo Tinga2026-05-25
💻 computer science

Reflections on the design, applications and implementations of the normative specification language eFLINT

यह शोधपत्र eFLINT के डिज़ाइन, अनुप्रयोगों और कार्यान्वयन पर विचार करता है, जो एक डोमेन-विशिष्ट भाषा है जिसे हाइब्रिड डिक्लेरेटिव-प्रोसेड्यूरल दृष्टिकोण के माध्यम से कानूनी और कम्प्यूटेशनल तर्क को जोड़कर कानूनों और विनियमों के साथ सॉफ़्टवेयर अनुपालन को स्वचालित करने के लिए बनाया गया है।

L. Thomas van Binsbergen, Christopher A. Esterhuyse, Tim Müller2026-05-25