💻 computer science

Agentic Generation of AST Transformation Rules for Fixing Breaking Updates

यह शोध पत्र BigBag प्रस्तुत करता है, जो एक एजेंटिक फ्रेमवर्क है जो कई सॉफ्टवेयर प्रोजेक्ट्स में ब्रेकिंग डिपेंडेंसी अपडेट्स को स्वचालित रूप से ठीक करने के लिए पुन: प्रयोज्य (reusable), API-स्तरीय AST ट्रांसफॉर्मेशन रूल्स जनरेट करता है, जो उच्च कंपाइलेशन और फिक्स दरों को प्राप्त करते हुए महत्वपूर्ण क्रॉस-प्रोजेक्ट ट्रांसफ़रेबिलिटी प्रदर्शित करता है।

Frank Reyes, Benoit Baudry, Martin Monperrus2026-06-24
💻 computer science

MANGO: Automated Multi-Agent Test Oracle Generation for Vision-Language-Action Models

यह शोध पत्र MANGO को प्रस्तुत करता है, जो एक मल्टी-एजेंट फ्रेमवर्क है जो विजन-लैंग्वेज-एक्शन (VLA) रोबोट्स के लिए मैनुअल सिम्बोलिक टेस्टिंग की स्केलेबिलिटी और डायग्नोस्टिक सीमाओं को दूर करने हेतु प्राकृतिक भाषा विवरणों से स्वचालित रूप से सूक्ष्म-स्तरीय, निष्पादन योग्य टेस्ट ओरेकलल्स (test oracles) उत्पन्न करता है।

Pablo Valle, Shaukat Ali, Aitor Arrieta, Lionel Briand2026-06-24
💻 computer science

Demystifying Dependency Bugs in Deep Learning Stack

यह शोध पत्र 446 वास्तविक मामलों का विश्लेषण करके डीप लर्निंग स्टैक में डिपेंडेंसी बग्स (dependency bugs) के लक्षणों, मूल कारणों और सुधार पैटर्न को चित्रित करते हुए, विषम डीएल इकोसिस्टम (heterogeneous DL ecosystem) में डिपेंडेंसी प्रबंधन को बेहतर बनाने के लिए व्यावहारिक अंतर्दृष्टि प्रदान करते हुए, डीप लर्निंग स्टैक में डिपेंडेंसी बग्स का पहला व्यापक अध्ययन प्रस्तुत करता है।

Kaifeng Huang, Bihuan Chen, Susheng Wu, Junmin Cao, Lei Ma, Xin Peng2026-06-23
💻 computer science

Killing Two Birds with One Stone: Malicious Package Detection in NPM and PyPI using a Single Model of Malicious Behavior Sequence

यह शोध पत्र सेरेब्रो (Cerebro) को पेश करता है, जो एक एकीकृत डीप लर्निंग मॉडल है जो क्रॉस-इकोसिस्टम ज्ञान को संलयित करने और अनुक्रमिक दुर्भावनापूर्ण पैटर्न को पकड़ने के लिए व्यवहार अनुक्रमों (behavior sequences) के एक उच्च-स्तरीय एब्स्ट्रैक्शन का लाभ उठाकर NPM और PyPI दोनों इकोसिस्टम में दुर्भावनापूर्ण पैकेजों का पता लगाता है, और सफलतापूर्वक सैकड़ों नए खतरों की पहचान करता है।

Junan Zhang, Kaifeng Huang, Yiheng Huang, Bihuan Chen, Ruisi Wang, Chong Wang, Xin Peng2026-06-23
💻 computer science

Detecting and Fixing Violations of Modification Terms in Open Source Licenses during Forking

यह शोध पत्र LiVo को प्रस्तुत करता है, जो एक ऐसा टूल है जिसे फ़ोर्किंग के दौरान ओपन सोर्स लाइसेंस के संशोधन संबंधी शर्तों (modification terms) के उल्लंघन को स्वचालित रूप से पहचानने और ठीक करने के लिए डिज़ाइन किया गया है, जो 47 लाइसेंसों के अनुभवजन्य लक्षण वर्णन (empirical characterization) और मर्ज किए गए पुल रिक्वेस्ट के माध्यम से सफल सत्यापन द्वारा कानूनी जोखिम न्यूनीकरण के एक पूर्व में अनछुए अंतराल को संबोधित करता है।

Kaifeng Huang, Yingfeng Xia, Bihuan Chen, Zhuotong Zhou, Jin Guo, Xin Peng2026-06-23
💻 computer science

Towards a unified user modeling language for engineering human centered AI systems

यह शोध पत्र एक एकीकृत उपयोगकर्ता मॉडलिंग भाषा का प्रस्ताव करता है जो मौजूदा मोटे-स्तर के दृष्टिकोणों की सीमाओं को दूर करने के लिए विविध उपयोगकर्ता प्रोफाइल आयामों को एकीकृत करता है, और BESSER लो-कोड प्लेटफॉर्म पर इसके कार्यान्वयन और एआई संवादात्मक एजेंटों को स्वचालित रूप से अनुकूलित करने के प्रमाण-अवधारणा (प्रूफ-ऑफ-कॉन्सेप्ट) के माध्यम से इसकी प्रभावशीलता को प्रदर्शित करता है।

Aaron Conrardy, Alfredo Capozucca, Jordi Cabot2026-06-23
💻 computer science

CodeChemist: Functional Knowledge Transfer for Low-Resource Code Generation via Test-Time Scaling

CodeChemist एक प्रशिक्षण-मुक्त (training-free), टेस्ट-टाइम स्केलिंग फ्रेमवर्क है जो सिंथेसाइज्ड टेस्ट केसेस और अनिश्चितता अनुमान (uncertainty estimation) पर आधारित एक दोहरी-रणनीति चयन तंत्र के माध्यम से उच्च-संसाधन वाली भाषाओं से कार्यात्मक ज्ञान को स्थानांतरित करके कम-संसाधन और जटिल-सिंटैक्स वाली प्रोग्रामिंग भाषाओं के लिए कोड जनरेशन को बढ़ाता है।

Kaixin Wang, Tianlin Li, Xiaoyu Zhang, Aishan Liu, Xianglong Liu, Ziqi Liu, Zhiqiang Zhang, Jun Zhou, and Bin Shi2026-06-23
💻 computer science

MCP-SandboxScan: WASM-based Secure Execution and Runtime Analysis for MCP Tools

यह शोध पत्र SandScope को प्रस्तुत करता है, जो एक MCP-सचेत ऑडिट फ्रेमवर्क है जो WebAssembly-आधारित सुरक्षित निष्पादन, रनटाइम विटनेस डिटेक्शन और सिमेंटिक टूल प्रोफाइलिंग को संयोजित करता है ताकि उन कन्फ्यूज्ड-डेप्युटी (confused-deputy) जोखिमों की पहचान और रिपोर्ट कर सके जहाँ हमलावर-नियंत्रित इनपुट के कारण निर्दोष MCP टूल्स LLM एजेंट संदर्भों के भीतर संवेदनशील डेटा लीक करते हैं या अनधिकृत संचालन निष्पादित करते हैं।

Zhuoran Tan, Run Hao, Jeremy Singer, Yutian Tang, Christos Anagnostopoulos2026-06-23
💻 computer science

A Low-Code Approach for the Automatic Personalization of Conversational Agents

यह शोध पत्र एक व्यवस्थित साहित्य समीक्षा प्रस्तुत करता है जो यह प्रकट करता है कि मॉडल-ड्रिवन इंजीनियरिंग में वर्तमान यूजर मॉडलिंग खंडित, स्थिर और मजबूत टूल सपोर्ट की कमी वाली है, जिससे कन्वर्सेशनल एजेंट्स के डायनेमिक, लो-कोड पर्सनलाइजेशन के लिए यूनिफाइड, रियूजेबल मॉडल्स और ऑटोमेटेड, एमएल-ड्रिवन पाइपलाइन्स की ओर एक रोडमैप प्रस्तावित किया गया है।

Aaron Conrardy, Alfredo Capozucca, Jordi Cabot2026-06-23
🤖 AI

Specifying AI-SDLC Processes: A Protocol Language for Human-Agent Boundaries

यह शोध पत्र AI-SDLC प्रक्रियाओं को निर्दिष्ट करने के लिए एक औपचारिक डोमेन-विशिष्ट भाषा का प्रस्ताव करता है जो संरचनात्मक प्रवर्तन प्रिमिटिव्स (structural enforcement primitives) के माध्यम से मानव-एजेंट सीमाओं को परिभाषित करता है, नीति को तंत्र से अलग करता है ताकि सिस्टम विफलता दरों को सीमित किया जा सके और मल्टी-एजेंट सॉफ्टवेयर विकास में कर्तव्यों के पृथक्करण को औपचारिक रूप दिया जा सके।

Ylli Prifti2026-06-23