🤖 AI

LiveFMBench: Unveiling the Power and Limits of Agentic Workflows in Specification Generation

यह शोध पत्र LiveFMBench पेश करता है, जो 630 C प्रोग्रामों का एक संदूषण-जागरूक (contamination-aware) बेंचमार्क है, जो LLM और एजेंट-आधारित औपचारिक विनिर्देश (formal specification) पीढ़ी का व्यवस्थित रूप से मूल्यांकन करता है, यह प्रकट करते हुए कि अनैतिक मॉडल व्यवहारों के कारण सरल मूल्यांकन प्रदर्शन को काफी अधिक बढ़ा-चढ़ाकर दिखाते हैं और जबकि एजेंटिक पाइपलाइन और रीजनिंग मोड सटीकता में सुधार करते हैं, वर्तमान दृष्टिकोण मानव-लिखित विनिर्देशों को प्रतिस्थापित करने से अभी भी बहुत दूर हैं।

Dong Xu, Jialun Cao, Guozhao Mo, Junjie Hu, Cheng Wen, Hongyu Lin, Xianpei Han, Shengchao Qin, Cong Tian, Shing-Chi Cheu (…)2026-05-06
🤖 AI

SCALE-LoRA: Auditing Post-Retrieval LoRA Composition with Residual Merging and View Reliability

यह शोध पत्र SCALE को प्रस्तुत करता है, जो एक ओपन पूल से रिट्रीव किए गए LoRA एडेप्टर के ऑडिटिंग और कंपोजिशन के लिए एक फ्रेमवर्क है, जो मर्ज इंटरफेरेंस को कम करने के लिए एक डिप्लॉय करने योग्य लेयर-एडेप्टिव स्पार्स रेसिडुअल कंपोजिशन (LASRC) विधि और मल्टी-व्यू डिसअग्रीमेंट का पता लगाने के लिए एक रिलायबिलिटी-एनालिसिस लेयर का उपयोग करता है, जिससे सीमित सपोर्ट डेटा के साथ प्रभावी टास्क रियूज़ सक्षम होता है।

Shuaipeng Zhou, Yu Zhang2026-05-06
🤖 AI

Rethinking Explanations: Formalizing Contrast in Description Logics

यह शोध पत्र डिस्क्रिप्शन लॉजिक्स (Description Logics) में कंट्रास्टिव स्पष्टीकरणों (contrastive explanations) के लिए एक उपयोगकर्ता-केंद्रित ढांचे का प्रस्ताव करता है जो मौजूदा जस्टिफिकेशन और एब्डक्टिव रीजनिंग विधियों की सीमाओं को संबोधित करता है, क्योंकि यह औपचारिक रूप से परिभाषित और मूल्यांकन करता है कि किसी वैकल्पिक फॉयल (foil) के बजाय कोई तथ्य क्यों सत्य है, इसे कैसे समझाया जाए।

Yasir Mahmood, Arnab Sharma, Axel-Cyrille Ngonga Ngomo, Balram Tiwari2026-05-06
🤖 AI

VisInject: Disruption != Injection -- A Dual-Dimension Evaluation of Universal Adversarial Attacks on Vision-Language Models

यह शोध पत्र तर्क देता है कि विजन-लैंग्वेज मॉडल्स पर यूनिवर्सल एडवरसैरियल अटैक्स के लिए उच्च रिपोर्ट की गई सफलता दरें सामान्य आउटपुट परटरबेशन (परिवर्तन) और सटीक प्रॉम्प्ट इंजेक्शन के बीच भ्रम पैदा करती हैं, जो एक नवीन द्वैत-आयामी मूल्यांकन के माध्यम से यह प्रकट करती हैं कि जहाँ अदृश्य परटरबेशन्स अक्सर मॉडल आउटपुट्स को बाधित करते हैं, वहीं वे शायद ही कभी वास्तविक इंजेक्शन प्राप्त कर पाते हैं, जिसमें परीक्षण किए गए मामलों में से केवल 0.756% ही किसी भी 'नॉन-नॉन' इंजेक्शन टियर तक पहुँच पाते हैं।

Pang Liu, Yingjie Lao2026-05-06
🤖 AI

SRGAN-CKAN: Expressive Super-Resolution with Nonlinear Functional Operators under Minimal Resources

यह शोध पत्र SRGAN-CKAN का प्रस्ताव करता है, जो एक संसाधन-कुशल सुपर-रिज़ॉल्यूशन फ्रेमवर्क है जो रैखिक कनवल्शन को अभिव्यंजक गैर-रैखिक कार्यात्मक ऑपरेटरों से बदलने के लिए एक एडवरसेरियल सेटिंग में कनवल्शनल कोलमोगोरोव-आर्नोल्ड नेटवर्क को एकीकृत करता है, जिससे सीमित कम्प्यूटेशनल संसाधनों के तहत धारणात्मक गुणवत्ता और पुनर्निर्माण निष्ठा के बीच एक बेहतर संतुलन प्राप्त होता है।

Roberto Isai Navaro-Aviña, Eduardo Said Merin-Martinez, Andres Mendez-Vazquez, Eduardo Rodriguez-Tello2026-05-06
🤖 AI

Grounding Multi-Hop Reasoning in Structural Causal Models via Group Relative Policy Optimization

यह शोध पत्र एक नवीन ढांचे का प्रस्ताव करता है जो मल्टी-हॉप तथ्य सत्यापन (multi-hop fact verification) को स्ट्रक्चरल कॉज़ल मॉडल्स (Structural Causal Models) में स्थापित करता है और एक नियम-आधारित ग्रुप रिलेटिव पॉलिसी ऑप्टिमाइज़ेशन (Rule-based Group Relative Policy Optimization - GRPO) रणनीति के माध्यम से रीजनिंग चेन की जटिलता को अनुकूलित करता है, जो भ्रम (hallucinations) और रीजनिंग की गहराई एवं सटीकता के बीच इनवर्टेड यू-शेप्ड (inverted U-shaped) संबंध को संबोधित करते हुए अत्याधुनिक बेसलाइनों से काफी बेहतर प्रदर्शन करता है।

Yunhan Bu, Quan Zhang, Huaping Zhang, Guotong Geng, Chunxiao Gao, Askar Hamdulla, Juan Wang, Qiuchi Li, Baohua Zhang, Sh (…)2026-05-06
🤖 AI

6G Needs Agents: Toward Agentic AI-Native Networks for Autonomous Intelligence

यह शोध पत्र एक चार-स्तरीय आर्किटेक्चर का प्रस्ताव करते हुए एजेंटिक एआई-नेटिव (Agentic AI-Native) 6G नेटवर्क की ओर एक प्रतिमान परिवर्तन (paradigm shift) की वकालत करता है, जो सिमेंटिक रीजनिंग और ऑर्केस्ट्रेशन के लिए एलएलएम-आधारित (LLM-based) एजेंटों को एकीकृत करता है, और यह अनुभवजन्य अध्ययन के माध्यम से प्रदर्शित करता है कि तर्क क्षमता (reasoning capability) और सिस्टम दक्षता के बीच मौलिक ट्रेडऑफ़ को संतुलित करने के लिए एक हेटेरोजेनियस डिवाइस-एज-कोर परिनियोजन आवश्यक है।

Mohamed Amine Ferrag, Abderrahmane Lakas, Merouane Debbah2026-05-06
🤖 AI

Neuro-Symbolic Agents for Hallucination-Free Requirements Reuse

यह शोध पत्र एक न्यूरो-सिम्बोलिक मल्टी-एजेंट सिस्टम प्रस्तुत करता है जो OOMRAM फ्रेमवर्क के भीतर भ्रम-मुक्त (hallucination-free) और संरचनात्मक रूप से वैध आवश्यकताओं के पुन: उपयोग को सक्षम करने के लिए हीयुरिस्टिक्स (heuristics) के रूप में लार्ज लैंग्वेज मॉडल्स को एक नियतात्मक सिम्बोलिक वैलिडेटर के साथ जोड़ता है, जिससे 100% कवरेज और शून्य के करीब बाधा उल्लंघन (constraint violations) प्राप्त होता है।

Ahmed Ibrahim2026-05-06
🤖 AI

KG-First, LLM-Fallback: A Hybrid Microservice for Grounded Skill Search and Explanation

यह शोध पत्र SkillGraph-Service प्रस्तुत करता है, जो एक हाइब्रिड माइक्रोसर्विस है जो जटिल सक्षमता ढांचों (competency frameworks) को एक नॉलेज ग्राफ में एकीकृत करता है ताकि प्रतीकात्मक पुनर्प्राप्ति (symbolic retrieval) को प्राथमिकता देते हुए शिक्षकों के लिए उच्च-सटीक, कम-विलंबता वाली कौशल खोज और स्पष्टीकरण प्राप्त किया जा सके, जिसमें LLMs का उपयोग कड़ाई से सीमित रैंकिंग और दर्शक-जागरूक सारांशीकरण के लिए किया जाता है।

Ngoc Luyen Le, Marie-Hélène Abel, Bertrand Laforge2026-05-06
🤖 AI

Evaluating Agentic AI in the Wild: Failure Modes, Drift Patterns, and a Production Evaluation Framework

यह शोधपत्र एजेंटिक एआई (agentic AI) के लिए सात उत्पादन-विशिष्ट विफलता मोड (production-specific failure modes) का एक वर्गीकरण प्रस्तुत करता है, उन्हें पहचानने में मौजूदा मूल्यांकन मेट्रिक्स की अपर्याप्तता को प्रदर्शित करता है, और वास्तविक दुनिया के परिनियोजन के लिए एक निरंतर, पांच-आयामी समाधान के रूप में प्रोडक्शन एजेंटिक इवैल्यूएशन फ्रेमवर्क (Production Agentic Evaluation Framework - PAEF) का प्रस्ताव करता है।

Mukund Pandey2026-05-06