🤖 AI

Beyond Compilation: Evaluating Faithful Natural-Language-to-Lean Statement Formalization

यह शोध पत्र यह तर्क देता है कि प्राकृतिक-भाषा-से-लीन (natural-language-to-Lean) औपचारिकीकरण का मूल्यांकन करने के लिए केवल लीन संकलन दरों (Lean compilation rates) पर निर्भर रहना भ्रामक है क्योंकि सिंटैक्टिक वैधता और सिमेंटिक निष्ठा के बीच एक महत्वपूर्ण अंतर है, और यह एक कठोर मानव-कैलिब्रेटेड सर्वसम्मति मीट्रिक का प्रस्ताव करता है तथा औपचारिक कथन की सटीकता में सुधार के लिए एलैबोरेशन फीडबैक (elaboration feedback) को सबसे महत्वपूर्ण हस्तक्षेप के रूप में पहचानता है।

Ke Zhang, Patricio Gallardo Candela, Sudhir Murthy, Yi Xie, Zhi Wang, Maziar Raissi2026-07-01
💬 NLP

CORTEX: Token-Level Hallucination Detection in RAG via Comparative Internal Representations

यह शोध पत्र CORTEX का प्रस्ताव करता है, जो रिट्रीवल-ऑगमेंटेड जनरेशन (Retrieval-Augmented Generation) के लिए एक टोकन-स्तरीय मतिभ्रम (hallucination) पहचान पद्धति है, जो रिट्रीव किए गए दस्तावेज़ों के साथ और उनके बिना मॉडल के आंतरिक निरूपणों (internal representations) की तुलना करके गैर-आधारित सामग्री की पहचान करती है, जबकि यह मतिभ्रम के सूक्ष्म स्थानीयकरण (fine-grained localization) को प्राप्त करने के लिए सूचना प्रसार (information propagation) और स्पैन-कंसिस्टेंट स्मूथिंग (span-consistent smoothing) का लाभ उठाती है।

Kazuaki Furumai, Shuichiro Haruta, Kazunori Matsumoto, Daisuke Kamisaka2026-07-01
💬 NLP

Truth or Sophistry? LoFa: A Benchmark for LLM Robustness Against Logical Fallacies

यह शोध पत्र LoFa प्रस्तुत करता है, जो एक व्यापक बेंचमार्क और मूल्यांकन ढांचा है जिसमें विभिन्न तार्किक दोषों (logical fallacies) के विरुद्ध लार्ज लैंग्वेज मॉडल्स की मजबूती का आकलन और मात्रा निर्धारण करने के लिए एक बहु-चरणीय बहस प्रणाली और एक नवीन LFR@k मीट्रिक शामिल है, जो विभिन्न मॉडल्स के बीच विशिष्ट भेद्यता प्रोफाइल (vulnerability profiles) को प्रकट करता है।

Xudong Shen, Li Yuan, Ye Chen, Xin Wu, Yi Cai, Zhiyong Wu2026-07-01
💬 NLP

A Semantic-Layer-Mediated Agent for Natural Language to SQL over Heterogeneous Enterprise Databases

यह शोध पत्र एक सिमेंटिक-लेयर-मध्यस्थ एजेंट प्रस्तुत करता है जो एक सिमेंटिक मॉडल क्वेरी (SMQ) मध्यवर्ती प्रतिनिधित्व और एक नियत कंपाइलर के माध्यम से प्राकृतिक भाषा के इरादे को भौतिक SQL निष्पादन से अलग करता है, जो Spider2-snow बेंचमार्क पर 94.15% निष्पादन सटीकता प्राप्त करता है और विषम एंटरप्राइज डेटाबेस के लिए केवल स्कीमा-आधारित दृष्टिकोणों की तुलना में काफी बेहतर प्रदर्शन करता है।

Ha Jeong Kim, Saksonita Khoeurn, Ye Ji Yoon2026-07-01
💬 NLP

ADAPT: Attention Dynamics Alignment with Preference Tuning for Faithful MLLMs

यह शोध पत्र ADAPT को प्रस्तुत करता है, जो एक अटेंशन-आधारित फ्रेमवर्क है जो विजुअल एंकर्स, ऑनलाइन करेक्शन मैकेनिज्म और प्रेफरेंस ट्यूनिंग के माध्यम से टेक्स्ट-टू-इमेज क्रॉस-अटेंशन डायनेमिक्स को संरेखित करके मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स में मतिभ्रम (hallucinations) को कम करता है, जिससे सामान्य क्षमताओं को बनाए रखते हुए मतिभ्रम में महत्वपूर्ण कमी आती है।

Zhiyuan Yao, Zheren Fu, Zhixiao Zheng, Jiajun Li, Yi Tu, Zhendong Mao2026-07-01
💬 NLP

Reference-Based Prosody and Rhythm Evaluation for Spoken Dialogue Systems

यह शोधपत्र स्पोकन डायलॉग सिस्टम्स के लिए एक संदर्भ-आधारित मूल्यांकन ढांचे का प्रस्ताव करता है जो प्रोसोडी (prosody) और रिदम (rhythm) के लिए व्याख्या योग्य, पर्सेंटाइल-आधारित मेट्रिक्स उत्पन्न करने हेतु मेल खाते हुए मानव वार्तालाप स्तरों (human conversation strata) का उपयोग करता है, जिससे स्टेट-कंडीशन्ड स्पीच बिहेवियर्स के आकलन में पूल्ड स्टैटिस्टिक्स (pooled statistics) की कैलिब्रेशन सीमाओं को दूर किया जा सके।

Ashish Hallur, Thomas Thebaud, Georgi Tinchev, Venkatesh Ravichandran, Laureano Moro-Velazquez2026-07-01
💬 NLP

Exploring the relationship between team institutional composition and novelty in academic papers based on fine-grained knowledge entities

यह अध्ययन प्राकृतिक भाषा प्रसंस्करण (नेचुरल लैंग्वेज प्रोसेसिंग) के शोध पत्रों का विश्लेषण करता है जिससे यह पता चलता है कि मिश्रित अकादमिक-औद्योगिक टीमें विशुद्ध रूप से औद्योगिक टीमों की तुलना में अधिक नवीन शोध उत्पन्न करती हैं, जिसमें इस बात के स्पष्ट अंतर हैं कि ये समूह विधि-मापन (मेथड-मेट्रिक) बनाम विधि-उपकरण (मेथड-टूल) संयोजनों की नवीनता को कैसे प्राथमिकता देते हैं।

Ziling Chen, Chengzhi Zhang, Heng Zhang, Yi Zhao, Chen Yang, Yang Yang2026-07-01
💬 NLP

Building a Multimodal Dataset of Academic Paper for Keyword Extraction

यह अध्ययन टेक्स्ट, इमेज और ऑडियो युक्त 1,000 शैक्षणिक शोध पत्रों का एक नया डेटासेट बनाकर कीवर्ड निष्कर्षण (keyword extraction) के लिए मल्टीमॉडल संसाधनों की कमी को संबोधित करता है, जो यह प्रदर्शित करता है कि इन विविध मोडैलिटीज से जानकारी को मिलाना केवल टेक्स्ट का उपयोग करने की तुलना में निष्कर्षण प्रदर्शन में महत्वपूर्ण सुधार करता है।

Jingyu Zhang, Xinyi Yan, Yi Xiang, Yingyi Zhang, Chengzhi Zhang2026-07-01
💬 NLP

Triospect: A Three-Dimensional Framework for Robust Statistical AI-Generated Text Detection Against Diverse Attacks

यह शोध पत्र ट्रायोस्पेक्ट (Triospect) को प्रस्तुत करता है, जो एक नवीन त्रि-आयामी सांख्यिकीय ढांचा है जो विविध प्रतिकूल हमलों के विरुद्ध एआई-जनित पाठ का पता लगाने की मजबूती को महत्वपूर्ण रूप से बढ़ाने के लिए विषय-वस्तु और अभिव्यक्ति के दृष्टिकोणों को एकीकृत करता है, और कई बेंचमार्क में मौजूदा बेसलाइन की तुलना में पर्याप्त अंतर से बेहतर प्रदर्शन करता है।

Guangsheng Bao, Lihua Rong, Yanbin Zhao, Xiao Yu, Qiji Zhou, Yue Zhang2026-07-01
💬 NLP

Usage frequency and application variety of research methods in library and information science: Continuous investigation from 1991 to 2021

यह अध्ययन 1991 से 2021 तक के 26,000 से अधिक एलआईएस (LIS) लेखों का विश्लेषण करने के लिए मशीन लर्निंग का उपयोग करता है, जो विशिष्ट अनुसंधान विषयों और पद्धतियों के बीच गतिशील संबंधों को मैप करते हुए, तीन दशकों के महत्वपूर्ण बदलाव को प्रकट करता है जो वैचारिक, प्रणाली-केंद्रित अनुसंधान से अनुभवजन्य, उपयोगकर्ता-केंद्रित जांच की ओर हुआ है।

Chengzhi Zhang, Liang Tian, Heting Chu2026-07-01