💻 computer science

A Multi-Layer Testing Framework for Automated Data Quality Assurance in Cloud-Native ELT Pipelines

यह शोध पत्र क्लाउड-नेटिव ELT पाइपलाइनों के लिए एक एकीकृत, बहु-स्तरीय परीक्षण ढांचे को प्रस्तुत करता है जो ऑर्केस्ट्रेशन-स्तर के सत्यापन, डिक्लेरेटिव dbt परीक्षणों और LLM-जनित सिमेंटिक परीक्षणों को एकीकृत करता है, और नियंत्रित प्रयोगों के माध्यम से यह प्रदर्शित करता है कि यह दृष्टिकोण परिचालन व्यावहारिकता बनाए रखते हुए मैनुअल बेसलाइन की तुलना में विसंगति का पता लगाने (anomaly detection) में 128.57% का सुधार प्राप्त करता है।

Ismail Gargouri, Hassan Reza2026-05-21✓ Author reviewed
💬 NLP

Multi-agent Collaboration with State Management

यह शोधपत्र STORM को प्रस्तुत करता है, जो एक स्टेट-ओरिएंटेड (state-oriented) प्रबंधन ढांचा है जो कोडिंग बेंचमार्क पर पारंपरिक वर्कस्पेस आइसोलेशन बेसलाइन की तुलना में काफी बेहतर प्रदर्शन करते हुए और साझा कोडबेस के सुसंगत दृश्यों को सुनिश्चित करते हुए, राइट टाइम (write time) पर कोड संघर्षों का पता लगाने और उन्हें हल करने के लिए मल्टी-एजेंट इंटरैक्शन को मध्यस्थता प्रदान करता है।

Mengyang Liu, Taozhi Chen, Zhenhua Xu, Xue Jiang, Yihong Dong2026-05-21
💻 computer science

An Event-Driven Tool for Context-Aware Code Smell Detection Using SmellDSL

यह शोध पत्र स्मेलहंटर (SmellHunter) प्रस्तुत करता है, जो एक इवेंट-ड्रिवन, कॉन्टेक्स्ट-अवेयर टूल है जो कोड स्मेल्स का पता लगाने और इकलिप्स (Eclipse) वातावरण के भीतर सूचित रिफैक्टरिंग निर्णयों के लिए स्थान-आधारित अंतर्दृष्टि प्रदान करने हेतु एक डोमेन-विशिष्ट भाषा (SmellDSL) के माध्यम से स्टैटिक कोड मेट्रिक्स को प्रोजेक्ट और टीम मेटाडेटा के साथ एकीकृत करता है।

Matheus dos Santos Viegas, Adrian Gabriel Keller dos Santos, Kleinner Farias, Robson Keemps da Silva2026-05-21
💻 computer science

Governance by Construction for Generalist Agents

यह शोध पत्र CUGA को प्रस्तुत करता है, जो एक मॉड्यूलर पॉलिसी-एज़-कोड सिस्टम है जो पांच संरचनात्मक चेकपॉइंट्स के माध्यम से जनरलिट LLM एजेंटों के निष्पादन पाइपलाइन में सीधे गवर्नेंस को समाहित करता है, जिससे मॉडल फाइन-ट्यूनिंग की आवश्यकता के बिना एंटरप्राइज वातावरण में सुरक्षित, ऑडिट योग्य और अनुपालन योग्य स्वायत्त संचालन सक्षम होता है।

Segev Shlomov, Iftach Shoham, Alon Oved, Ido Levy, Sami Marreed, Harold Ship, Offer Akrabi, Sergey Zeltyn, Avi Yaeli, Ni (…)2026-05-21
💬 NLP

ACL-Verbatim: hallucination-free question answering for research

यह शोध पत्र ACL-Verbatim को प्रस्तुत करता है, जो अनुसंधान के लिए एक भ्रम-मुक्त (hallucination-free) प्रश्न उत्तर प्रणाली है जो उपयोगकर्ता के प्रश्नों को ACL एंथोलॉजी में वर्बेटिम (verbatim) टेक्स्ट स्पैन से मैप करने के लिए एक्सट्रैक्टिव विधियों का उपयोग करती है, जिसे एक नए ग्राउंड ट्रुथ डेटासेट द्वारा समर्थित किया गया है जहाँ 150M-पैरामीटर वाला मॉडर्नबर्ट (ModernBERT) मॉडल अग्रणी LLM एक्सट्रैक्टर्स से बेहतर प्रदर्शन करता है।

Gábor Recski, Szilveszter Tóth, Nadia Verdha, István Boros, Ádám Kovács2026-05-21
💻 computer science

Detecting Trojaned DNNs via Spectral Regression Analysis

यह शोध पत्र MIST को प्रस्तुत करता है, जो एक ट्रोजन डिटेक्शन विधि है जो मॉडल के प्री-एक्टिवेशन स्पेक्ट्रल इवोल्यूशन में विचलन का विश्लेषण करके दुर्भावनापूर्ण फाइन-ट्यूनिंग अपडेट की पहचान करती है, और ट्रिगर या पॉइज़न्ड डेटा के ज्ञान की आवश्यकता के बिना उच्च सटीकता प्राप्त करती है।

Samuele Pasini, Jinhan Kim, Paolo Tonella2026-05-21
🤖 machine learning

Domain-Adaptable Reinforcement Learning for Code Generation with Dense Rewards

यह शोध पत्र प्रॉक्सिमल पॉलिसी ऑप्टिमाइज़ेशन का उपयोग करने वाले एक सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) ढांचे और एक अनुकूलन योग्य, निष्पादन-जागरूक पुरस्कार प्रणाली को पेश करता है ताकि बड़े भाषा मॉडलों को फाइन-ट्यून किया जा सके, जो कोड जनरेशन कार्यों में कार्यात्मक शुद्धता और रोबोटिक्स जैसे डोमेन-विशिष्ट बाधाओं के प्रति उनकी अनुकूलन क्षमता में महत्वपूर्ण सुधार करता है।

Erfan Aghadavoodi Jolfaei, Daniel Maninger, Abhinav Anand, Mert Tiftikci, Mira Mezini2026-05-21
💻 computer science

Beyond the Tip of the Iceberg: Understanding SATD in Dockerfiles through the Lens of Co-evolution

यह अध्ययन प्रकट करता है कि डॉकरफाइल्स (Dockerfiles) में स्व-स्वीकृत तकनीकी ऋण (SATD) का विश्लेषण केवल एकल-फ़ाइल परिप्रेक्ष्य के माध्यम से करना अधूरा है, क्योंकि ऋण स्वीकृति और पुनर्भुगतान की घटनाओं का एक महत्वपूर्ण हिस्सा स्रोत कोड परिवर्तनों के साथ जुड़ा हुआ है, जिसमें बाहरी निर्भरता संबंधी मुद्दे प्रवेश (admissions) को संचालित करते हैं और वास्तुशिल्प पुनर्गठन (architectural refactoring) पुनर्भुगतान को सक्षम बनाता है।

Wei Minn, Yan Naing Tun, Biniam Fesseha Demissie, Rui'ang Hu, Jiakun Liu, Mariano Ceccato, Lwin Khin Shar, David Lo2026-05-21
🤖 machine learning

Insights Generator: Systematic Corpus-Level Trace Diagnostics for LLM Agents

यह शोध पत्र 'इनसाइट्स जनरेटर' (IG) को प्रस्तुत करता है, जो एक मल्टी-एजेंट सिस्टम है जो बड़े पैमाने पर निष्पादन ट्रेस कॉर्पोरा (execution trace corpora) का व्यवस्थित रूप से विश्लेषण करके साक्ष्य-आधारित प्राकृतिक भाषा अंतर्दृष्टि (natural language insights) उत्पन्न करके LLM एजेंट विफलताओं के निदान को स्वचालित करता है, जो यह दिखाया गया है कि यह एजेंट के प्रदर्शन में महत्वपूर्ण सुधार करता है और गहराई एवं कवरेज में मैन्युअल नैदानिक विधियों से बेहतर प्रदर्शन करता है।

Akshay Manglik (Emily), Apaar Shanker (Emily), Kaustubh Deshpande (Emily), Jason Qin (Emily), Yash Maurya (Emily), Veron (…)2026-05-21
💻 computer science

Validating Navmesh using Geometry: Voxel-Based Analysis with Prioritized Exploration

यह शोध पत्र एक ज्यामिति-संचालित ढांचे (geometry-driven framework) को प्रस्तुत करता है जो वोक्सेल-आधारित विश्लेषण के माध्यम से चलने योग्य स्थान (walkable space) को पुनर्गठित करके और बड़े पैमाने के गेम वातावरण में नेविगेशन मेश और अंतर्निहित पर्यावरण ज्यामिति के बीच विसंगतियों का कुशलतापूर्वक पता लगाने के लिए सुदृढीकरण शिक्षण-निर्देशित प्राथमिकता अन्वेषण (reinforcement learning-guided prioritized exploration) का उपयोग करके नेविगेशन मेश को मान्य करता है।

Ramesh Raghavan, Ojas Sharma, Sebastien Larrue, Alan Isaac Kunder, Aakash Sai, Rishi Mathur2026-05-21