💻 computer science

VISOR: A Vision-Language Model-based Test Oracle for Testing Robots

यह शोधपत्र VISOR को प्रस्तुत करता है, जो एक विज़न-लैंग्वेज मॉडल-आधारित टेस्ट ऑरेकल है जो अनिश्चितता को परिमाणित करते हुए रोबोट कार्य की शुद्धता और गुणवत्ता के मूल्यांकन को स्वचालित करता है, यह प्रदर्शित करते हुए कि जबकि जेमिनी और GPT जैसे मॉडल पूरक प्रदर्शन क्षमताएं प्रदान करते हैं, उनके अनिश्चितता अनुमान वर्तमान में मूल्यांकन की शुद्धता का विश्वसनीय रूप से पूर्वानुमान लगाने में विफल रहते हैं।

Prasun Saurabh, Pablo Valle, Aitor Arrieta, Shaukat Ali, Paolo Arcaini2026-05-19
🤖 AI

Task-Level AI Readiness Assessment for Business Process Management:The T-IPO Model and LARA Matrix in Financial-Services IT Operations

यह शोध पत्र T-IPO मॉडल और LARA मैट्रिक्स प्रस्तुत करता है, जो एक कार्य-स्तरीय मूल्यांकन ढांचा है जिसे डेलफी अध्ययन और 127 वित्तीय आईटी कार्यों के अनुभवजन्य विश्लेषण के माध्यम से मान्य किया गया है, ताकि संज्ञानात्मक जटिलता और अनुपालन संवेदनशीलता का मूल्यांकन करके विशिष्ट वर्कफ़्लो कार्यों की लार्ज-लैंग्वेज-मॉडल एजेंट प्रतिस्थापन के लिए तत्परता को विश्वसनीय रूप से निर्धारित किया जा सके।

Mingjun Li, Xiaojun Ye2026-05-19
💻 computer science

TARIPlay: A Test Framework for AR Applications based on Interactive Area Tracking in Playback Videos

यह शोध पत्र TARIPlay प्रस्तुत करता है, जो ऑगमेंटेड रियलिटी अनुप्रयोगों के लिए एक परीक्षण ढांचा (टेस्ट फ्रेमवर्क) है जो गतिशील वातावरण और समय की सटीकता की चुनौतियों से पार पाने के लिए प्लेबैक वीडियो में इंटरैक्टिव एरिया ट्रैकिंग का लाभ उठाता है, जिससे मौजूदा उपकरणों की तुलना में परीक्षण कवरेज में उल्लेखनीय सुधार होता है।

Seyed Amir Mousavi, Xiaoyin Wang2026-05-19
💻 computer science

LLM-based vs. Search-based Merge Conflict Resolution: An Empirical Study of Competing Paradigms

यह अनुभवजन्य अध्ययन LLM-आधारित और खोज-आधारित मर्ज कॉन्फ्लिक्ट रेजोल्यूशन टूल्स की तुलना करता है, जो यह प्रकट करता है कि जहाँ LLMs असंतुलित सामग्री के साथ उत्कृष्ट प्रदर्शन करते हैं, वहीं खोज-आधारित विधियाँ बेहतर मजबूती और सामान्यीकरण प्रदान करती हैं, जो अंततः यह सुझाव देती हैं कि इष्टतम प्रदर्शन के लिए दोनों प्रतिमानों को संयोजित करने वाली हाइब्रिड प्रणालियाँ आवश्यक हैं।

Heleno de Souza Campos Junior, Leonardo Gresta Paulino Murta2026-05-19✓ Author reviewed
💻 computer science

Optimizing an IDE for an Evolving Language Ecosystem

यह शोधपत्र लैंग्वेज सर्वर प्रोटोकॉल और मौजूदा कोर कंपाइलर का लाभ उठाते हुए, विकसित होती मूव स्मार्ट कॉन्ट्रैक्ट भाषा के लिए एक उच्च-प्रदर्शन वाला IDE बनाने की रणनीति को रेखांकित करता है, साथ ही पारिस्थितिकी तंत्र के विकास को समर्थन देने के लिए आवश्यक बुनियादी ढांचे के अनुकूलन और सीखे गए अनुभवों का विवरण भी देता है।

Adam Welc, Todd Nowacki, Dario Russi, Cameron Swords, Timothy A. K. Zakian2026-05-19
💻 computer science

Low-Code Paradox in DevOps: Security and Governance Insights from Practitioners

यह अध्ययन डेवऑप्स (DevOps) परिवेशों में लो-कोड विकास प्लेटफार्मों को एकीकृत करने से उत्पन्न होने वाली सुरक्षा और गवर्नेंस चुनौतियों पर चिकित्सकों के दृष्टिकोण की जांच करता है, जो यह प्रकट करता है कि हालांकि ये उपकरण दक्षता बढ़ाते हैं, लेकिन इनके साथ जुड़े जोखिमों को कम करने के लिए मजबूत गवर्नेंस और सक्रिय सुरक्षा प्रथाओं की आवश्यकता होती है।

Muhammad Azeem Akbar, Saima Rafi, Arif Ali Khan2026-05-19
💻 computer science

Task Abstention for Large Language Models in Code Generation

यह शोध पत्र बड़े भाषा मॉडलों (Large Language Models) के लिए कोड जनरेशन कार्यों से बचने हेतु एक सैद्धांतिक रूप से आधारित, वितरण-मुक्त (distribution-free) विधि प्रस्तावित करता है, जो कोड निष्पादन परिणामों के माध्यम से जनरेशन निरंतरता का आकलन करके उन कार्यों को पहचानने में सक्षम है जिनके द्वारा भ्रम (hallucinations) उत्पन्न होने की संभावना है, जिससे बाहरी परीक्षण मामलों (external test cases) पर निर्भर किए बिना सुरक्षित और अधिक सुदृढ़ स्वचालित कोडिंग को सक्षम बनाया जा सके।

Yanke Zhou, Yuhao Tan, Senrong Xu, Zenan Li, Yuan Yao, Taolue Chen, Xiaoxing Ma2026-05-19
💻 computer science

The Range Shrinks, the Threat Remains: Re-evaluating LLM Package Hallucinations on the 2026 Frontier-Model Cohort

यह शोध पत्र स्प्रैकलन एट अल. के 2025 के एलएलएम (LLM) पैकेज मतिभ्रम (hallucinations) पर आधारित अध्ययन को पांच 2026 के फ्रंटियर मॉडल्स का उपयोग करके दोहराता और विस्तारित करता है, जिससे यह पता चलता है कि हालांकि मतिभ्रम की दर में काफी कमी आई है और मॉडल्स के बीच का अंतर कम हुआ है, फिर भी एक निरंतर खतरा बना हुआ है जो 127 मॉडल-अज्ञेय (model-agnostic) मतिभ्रम वाले पैकेज नामों के एक नए पहचाने गए सेट और विशिष्ट क्रॉस-इकोसिस्टम एवं क्रॉस-मॉडल व्यवहार संबंधी पैटर्न द्वारा अभिलक्षित है।

Aleksandr Churilov (Independent Researcher)2026-05-19✓ Author reviewed
💻 computer science

Rover: Context-aware Conflict Resolution with LLM

रोवर एक नवीन संघर्ष समाधान प्रणाली है जो प्रोग्राम विश्लेषण और एक मल्टी-लेयर कोड प्रॉपर्टी ग्राफ को एकीकृत करके लार्ज लैंग्वेज मॉडल्स को उन्नत करती है ताकि संदर्भ-जागरूक प्रॉम्प्ट उत्पन्न किए जा सकें, जिससे यह जटिल कोड मर्जिंग संघर्षों को सटीक रूप से हल करने में मौजूदा उपकरणों से बेहतर प्रदर्शन करती है।

Qingyu Zhang, Junzhe Li, Jiayi Lin, Changhua Luo, Chenxiong Qian2026-05-19
💻 computer science

ContractBench: Can LLM Agents Preserve Observation Contracts?

यह शोधपत्र ContractBench प्रस्तुत करता है, जो एक नियतात्मक (deterministic) बेंचमार्क है जो यह प्रकट करता है कि वर्तमान फ्रंटियर LLM एजेंट्स अक्सर ऑब्जर्वेशन कॉन्ट्रैक्ट्स (जैसे कि सेशन टोकन और URL) की टेम्पोरल वैधता और बाइट-लेवल अखंडता को बनाए रखने में विफल रहते हैं, एक ऐसी क्षमता जो मॉडल के आकार के साथ एकतुल्य रूप से (monotonically) नहीं बढ़ती है और जिसमें सुधार के लिए विशिष्ट फेल्योर-अवेयर ट्रेनिंग की आवश्यकता होती है।

Jicheng Wang, Yifeng He, Zili Wang, Hanwen Xing, Arkaprava De, Hao Chen2026-05-19