💬 NLP

Do Hallucination Neurons Generalize? Evidence from Cross-Domain Transfer in LLMs

यह शोध पत्र प्रदर्शित करता है कि लार्ज लैंग्वेज मॉडल्स में पहचाने गए "हैलुसिनेशन न्यूरॉन्स" विभिन्न ज्ञान डोमेन में सामान्यीकृत नहीं होते हैं, जो यह प्रकट करता है कि हैलुसिनेशन तंत्र सार्वभौमिक होने के बजाय डोमेन-विशिष्ट हैं और डोमेन-कैलिब्रेटेड डिटेक्टरों की आवश्यकता को अनिवार्य बनाते हैं।

Snehit Vaddi, Pujith Vaddi2026-04-23
🤖 machine learning

Accelerating PayPal's Commerce Agent with Speculative Decoding: An Empirical Study on EAGLE3 with Fine-Tuned Nemotron Models

यह अनुभवजन्य अध्ययन प्रदर्शित करता है कि PayPal के कॉमर्स एजेंट पर एक फाइन-ट्यून्ड नेमेट्रॉन (Nemotron) मॉडल के साथ EAGLE3 स्पेकुलेटिव डिकोडिंग को लागू करने से आउटपुट गुणवत्ता बनाए रखते हुए थ्रूपुट और लेटेंसी में महत्वपूर्ण सुधार प्राप्त होता है, जो अंततः मानक NVIDIA NIM डिप्लॉयमेंट की तुलना में GPU लागत में 50% की कमी सक्षम करता है।

Ally Qin, Jian Wan, Sarat Mudunuri, Srinivasan Manoharan2026-04-23
💬 NLP

PR-CAD: Progressive Refinement for Unified Controllable and Faithful Text-to-CAD Generation with Large Language Models

PR-CAD एक प्रगतिशील परिशोधन ढांचे (progressive refinement framework) को पेश करता है जो एक उच्च-निष्ठा वाले इंटरेक्शन डेटासेट और सुदृढीकरण लर्निंग (reinforcement learning) का लाभ उठाकर टेक्स्ट-टू-सीएडी (text-to-CAD) जनरेशन और संपादन को एक एकल, नियंत्रणीय एजेंट में एकीकृत करता है ताकि सीएडी मॉडलिंग में अत्याधुनिक निष्ठा और दक्षता प्राप्त की जा सके।

Jiyuan An, Jiachen Zhao, Fan Chen, Liner Yang, Zhenghao Liu, Hongyan Wang, Weihua An, Meishan Zhang, Erhong Yang2026-04-23
💻 computer science

From Actions to Understanding: Conformal Interpretability of Temporal Concepts in LLM Agents

यह शोध पत्र एक कॉन्फॉर्मल इंटरप्रिटेबिलिटी फ्रेमवर्क पेश करता है जो स्टेप-वाइज रिवॉर्ड मॉडलिंग को कॉन्फॉर्मल प्रेडिक्शन के साथ जोड़ता है ताकि एलएलएम (LLM) एजेंटों के भीतर रैखिक रूप से विभाज्य टेम्पोरल कॉन्सेप्ट्स की पहचान और नियंत्रण किया जा सके, जिससे जटिल संवादात्मक वातावरण में प्रारंभिक विफलता का पता लगाना और प्रदर्शन में सुधार करना सक्षम हो सके।

Trilok Padhi, Ramneet Kaur, Krishiv Agarwal, Adam D. Cobb, Daniel Elenius, Manoj Acharya, Colin Samplawski, Alexander M. (…)2026-04-23
💻 computer science

Do Small Language Models Know When They're Wrong? Confidence-Based Cascade Scoring for Educational Assessment

यह शोध पत्र प्रदर्शित करता है कि छोटे भाषा मॉडलों में मौखिक रूप से व्यक्त आत्मविश्वास, एक लागत-कुशल कैस्केड सिस्टम में शैक्षिक मूल्यांकन कार्यों को बड़े मॉडलों तक प्रभावी ढंग से रूट कर सकता है, बशर्ते कि छोटे मॉडल अनिश्चित मामलों की सटीक पहचान करने के लिए मजबूत आत्मविश्वास भेदभाव प्रदर्शित करें।

Tyler Burleigh2026-04-23
🔬 materials science

From Data to Theory: Autonomous Large Language Model Agents for Materials Science

यह शोध पत्र एक स्वायत्त लार्ज लैंग्वेज मॉडल एजेंट प्रस्तुत करता है जो एंड-टू-एंड, डेटा-संचालित सामग्री सिद्धांत विकास में सक्षम है जो सफलतापूर्वक स्थापित समीकरणों को पुनः प्राप्त करता है और नए संबंधों का प्रस्ताव देता है, जबकि मॉडल की गणितीय रूप से सटीक होने के बावजूद वैज्ञानिक रूप से गलत परिणाम उत्पन्न करने की क्षमता के कारण सावधानीपूर्वक सत्यापन की महत्वपूर्ण आवश्यकता पर प्रकाश डालता है।

Samuel Onimpa Alfred, Veera Sundararaghavan2026-04-23
💻 computer science

Hidden Reliability Risks in Large Language Models: Systematic Identification of Precision-Induced Output Disagreements

यह शोध पत्र PrecisionDiff को प्रस्तुत करता है, जो एक स्वचालित डिफरेंशियल टेस्टिंग फ्रेमवर्क है जो विभिन्न संख्यात्मक परिशुद्धता (numerical precision) कॉन्फ़िगरेशन के कारण होने वाले सूक्ष्म व्यवहार संबंधी मतभेदों और संभावित जेलब्रेक विचलन का पता लगाकर, लार्ज लैंग्वेज मॉडल्स में व्यापक, छिपे हुए विश्वसनीयता जोखिमों की व्यवस्थित रूप से पहचान करता है।

Yifei Wang, Tianlin Li, Xiaohan Zhang, Xiaoyu Zhang, Wei Ma, Mingfei Cheng, Li Pan2026-04-23
💻 computer science

Stabilising Generative Models of Attitude Change

यह शोध पत्र कॉनकोर्डिया (Concordia) लाइब्रेरी का उपयोग करते हुए एक जनरेटिव एक्टर-आधारित मॉडलिंग वर्कफ़्लो प्रस्तुत करता है जो अभिवृत्ति परिवर्तन के मौखिक सिद्धांतों (संज्ञानात्मक विसंगति, आत्म-संगति और आत्म-बोध) को निष्पादन योग्य सिमुलेशन में अनुवादित करता है, यह प्रदर्शित करते हुए कि शास्त्रीय मनोवैज्ञानिक निष्कर्षों का स्थिर पुनरुत्पादन प्राप्त करने के लिए एक मैनुअल "स्थिरीकरण" प्रक्रिया की आवश्यकता होती है जो मूल मौखिक विवरणों में निहित पूर्व में अनदस्तावेजीकृत परिचालन और सामाजिक-पारिस्थितिक निर्भरताओं को स्पष्ट करती है।

Jayd Matyas, William A. Cunningham, Alexander Sasha Vezhnevets, Dean Mobbs, Edgar A. Duéñez-Guzmán, Joel Z. Leibo2026-04-23
💻 computer science

Prism: An Evolutionary Memory Substrate for Multi-Agent Open-Ended Discovery

यह शोध पत्र प्रिज्म (Prism) को प्रस्तुत करता है, जो एक विकासवादी स्मृति आधार (evolutionary memory substrate) है जो एंट्रॉपी-गेटेड स्तरीकरण (entropy-gated stratification), कारण संबंधी स्मृति ग्राफ (causal memory graphs), और रेप्लिकेटर-डिके डायनेमिक्स (replicator-decay dynamics) के माध्यम से ओपन-एंडेड डिस्कवरी प्रदर्शन को महत्वपूर्ण रूप से बढ़ाने के लिए लेयर्ड पर्सिस्टेंस (layered persistence), वेक्टर और ग्राफ-आधारित मेमोरी, तथा मल्टी-एजेंट सर्च को एक निर्णय-सैद्धांतिक ढांचे (decision-theoretic framework) के तहत एकीकृत करता है।

Suyash Mishra2026-04-23
⚡ electrical engineering

Enhancing ASR Performance in the Medical Domain for Dravidian Languages

यह शोध पत्र एक नवीन कॉन्फिडेंस-अवेयर ट्रेनिंग फ्रेमवर्क प्रस्तावित करता है जो तेलुगु और कन्नड़ मेडिकल एएसआर (ASR) के लिए वर्ड एरर रेट को महत्वपूर्ण रूप से कम करने हेतु हाइब्रिड स्टैटिक और डायनेमिक मेट्रिक्स का उपयोग करके वास्तविक और सिंथेटिक स्पीच डेटा को एकीकृत करता है, जो क्रमशः मानक फाइन-ट्यूनिंग बेसलाइन से 8.5% और 6.3% बेहतर प्रदर्शन करता है।

Sri Charan Devarakonda, Ravi Sastry Kolluru, Manjula Sri Rayudu, Rashmi Kapoor, Madhu G, Anil Kumar Vuppala2026-04-23