💬 NLP

How Long Reasoning Chains Influence LLMs' Judgment of Answer Factuality

यह शोध पत्र व्यवस्थित रूप से इस बात की जांच करता है कि कैसे LLMs उत्तर की तथ्यात्मकता का निर्णय लगाने के लिए रीजनिंग चेन्स (तर्क श्रृंखलाओं) का उपयोग करते हैं, यह प्रकट करते हुए कि जहाँ तर्कीकरण सक्षम जजों की सहायता कर सकता है, वहीं कमजोर और मजबूत दोनों ही मॉडल सुव्यवस्थित लेकिन गलत तर्क द्वारा गुमराह होने के प्रति संवेदनशील बने रहते हैं, जो वास्तविक तर्क की गुणवत्ता और सतही प्रवाह के बीच अंतर करने वाले अधिक सुदृढ़ मूल्यांकन मेट्रिक्स की महत्वपूर्ण आवश्यकता को रेखांकित करता है।

Minzhu Tu, Shiyu Ni, Keping Bi2026-04-09
🤖 machine learning

Geometric Properties of the Voronoi Tessellation in Latent Semantic Manifolds of Large Language Models

यह शोध पत्र Qwen3.5-4B-Base के वोरोनोई टेसेलेशन (Voronoi tessellation) में अभिव्यक्तक्षमता अंतराल (expressibility gap) के लिए एक रैखिक स्केलिंग नियम (linear scaling law) को अनुभवजन्य रूप से मान्य करता है और यह प्रदर्शित करता है कि फिशर सूचना-आधारित मार्जिन परिशोधन (Fisher information-based margin refinement), डाउनस्ट्रीम प्रदर्शन को अपरिवर्तित रखते हुए, निर्णय मार्जिन (decision margins) में 28% सुधार करने के लिए मॉडल को ज्यामितीय रूप से पुनर्गठित कर सकता है, हालांकि इसकी व्यावहारिक उपयोगिता उच्च-आवृत्ति वाले संरचनात्मक टोकनों (high-frequency structural tokens) पर लाभों के संकेंद्रण के कारण सीमित है।

Marshall Brett2026-04-09
💬 NLP

Multi-Faceted Self-Consistent Preference Alignment for Query Rewriting in Conversational Search

यह शोध पत्र MSPA-CQR प्रस्तुत करता है, जो एक नवीन संवादात्मक क्वेरी पुनर्लेखन (conversational query rewriting) ढांचा है, जो बहु-आयामी प्राथमिकता डेटा का निर्माण करके और पुनर्प्राप्ति (retrieval) एवं प्रतिक्रिया निर्माण (response generation) फीडबैक के साथ पुनर्लेखन को संरेखित करने के लिए प्रीफिक्स-निर्देशित प्रत्यक्ष प्राथमिकता अनुकूलन (prefix-guided direct preference optimization) का उपयोग करके प्रदर्शन को बढ़ाता है।

Zhiyu Cao, Peifeng Li, Qiaoming Zhu2026-04-09
💬 NLP

Discourse Coherence and Response-Guided Context Rewriting for Multi-Party Dialogue Generation

यह शोध पत्र DRCR को प्रस्तुत करता है, जो एक नवीन ढांचा (framework) है जो विमर्श सुसंगतता (discourse coherence) और प्रतिक्रिया-निर्देशित संदर्भ पुनर्लेखन (response-guided context rewriting) का उपयोग करके बहु-पक्षीय संवाद पीढ़ी को बढ़ाता है, जिसे संदर्भ समझ और प्रतिक्रिया की गुणवत्ता दोनों को पुनरावृत्ति से सुधारने के लिए एक गतिशील स्व-विकास शिक्षण पद्धति द्वारा समर्थित किया गया है।

Zhiyu Cao, Peifeng Li, Qiaoming Zhu2026-04-09
💬 NLP

GCoT-Decoding: Unlocking Deep Reasoning Paths for Universal Question Answering

यह शोध पत्र GCoT-decoding प्रस्तुत करता है, जो एक प्रॉम्प्ट-मुक्त, दो-चरणीय ब्रांचिंग रणनीति है जो त्रुटि बैकट्रैकिंग के साथ विविध तर्क पथों को उत्पन्न करके और सार्वभौमिक प्रदर्शन सुधार प्राप्त करने के लिए उन्हें सिमेंटिक सर्वसम्मति के माध्यम से एकत्रित करके चेन-ऑफ-थॉट रीजनिंग को निश्चित और मुक्त-रूप प्रश्न-उत्तर कार्यों दोनों तक विस्तारित करता है।

Guanran Luo, Wentao Qiu, Zhongquan Jian, Meihong Wang, Qingqiang Wu2026-04-09
💬 NLP

AGSC: Adaptive Granularity and Semantic Clustering for Uncertainty Quantification in Long-text Generation

यह शोध पत्र AGSC का प्रस्ताव करता है, जो एक नवीन अनिश्चितता मात्रा निर्धारण (uncertainty quantification) ढांचा है जो लंबे पाठ निर्माण (long-text generation) के लिए, अप्रासंगिकता को फ़िल्टर करने हेतु NLI न्यूट्रल संभावनाओं का लाभ उठाता है और महत्वपूर्ण रूप से कम कम्प्यूटेशनल लागत के साथ अत्याधुनिक तथ्यात्मकता सहसंबंध (state-of-the-art factuality correlation) प्राप्त करने के लिए गॉसियन मिक्स्चर मॉडल-आधारित सिमेंटिक क्लस्टरिंग का उपयोग करता है।

Guanran Luo, Wentao Qiu, Wanru Zhao, Wenhan Lv, Zhongquan Jian, Meihong Wang, Qingqiang Wu2026-04-09
💬 NLP

SemEval-2026 Task 9: Detecting Multilingual, Multicultural and Multievent Online Polarization

यह शोध पत्र SemEval-2026 टास्क 9 प्रस्तुत करता है, जो एक बड़े पैमाने का साझा कार्य है जिसमें 67 टीमों ने तीन उप-कार्यों के माध्यम से 22 भाषाओं में बहुभाषी ऑनलाइन ध्रुवीकरण का पता लगाने का मूल्यांकन किया: ध्रुवीकरण की उपस्थिति, प्रकार और अभिव्यक्ति की पहचान करना।

Usman Naseem, Robert Geislinger, Juan Ren, Sarah Kohail, Rudy Garrido Veliz, P Sam Sahil, Yiran Zhang, Marco Antonio Str (…)2026-04-09
💬 NLP

HingeMem: Boundary Guided Long-Term Memory with Query Adaptive Retrieval for Scalable Dialogues

HingeMem एक स्केलेबल लॉन्ग-टर्म मेमोरी फ्रेमवर्क है जो संवाद प्रणालियों (डायलॉग सिस्टम्स) के लिए उपयोग किया जाता है, जो बाउंड्री-ट्रिगर्ड हाइपरएज इंडेक्सिंग बनाने के लिए इवेंट सेगमेंटेशन का उपयोग करता है और क्वेरी-एडेप्टिव रिट्रीवल मैकेनिज्म को नियोजित करता है, जिससे मौजूदा बेसलाइन्स की तुलना में प्रदर्शन और कम्प्यूटेशनल दक्षता में महत्वपूर्ण सुधार प्राप्त होता है।

Yijie Zhong, Yunfan Gao, Haofen Wang2026-04-09
💬 NLP

Digital Skin, Digital Bias: Uncovering Tone-Based Biases in LLMs and Emoji Embeddings

यह शोध पत्र पहला बड़े पैमाने पर तुलनात्मक अध्ययन प्रस्तुत करता है जो यह प्रकट करता है कि जहाँ आधुनिक लार्ज लैंग्वेज मॉडल्स स्किन-टोन्ड इमोजी का मजबूती से समर्थन करते हैं, वहीं विशेष इमोजी एम्बेडिंग मॉडल्स विभिन्न स्किन टोन्स के बीच सेंटिमेंट और सिमेंटिक निरंतरता में गंभीर कमियों और व्यवस्थित पूर्वाग्रहों को प्रदर्शित करते हैं, जो डेवलपर्स के लिए इन प्रतिनिधित्व संबंधी हानियों का ऑडिट करने और उन्हें कम करने की तत्काल आवश्यकता को रेखांकित करता है।

Mingchen Li, Wajdi Aljedaani, Yingjie Liu, Navyasri Meka, Xuan Lu, Xinyue Ye, Junhua Ding, Yunhe Feng2026-04-09
💬 NLP

iTAG: Inverse Design for Natural Text Generation with Accurate Causal Graph Annotations

यह शोधपत्र iTAG का प्रस्ताव करता है, जो एक नवीन इनवर्स डिज़ाइन फ्रेमवर्क है जो चेन-ऑफ-थॉट रीजनिंग और वास्तविक दुनिया के कॉन्सेप्ट असाइनमेंट का लाभ उठाकर अत्यधिक सटीक कॉज़ल ग्राफ एनोटेशन के साथ प्राकृतिक टेक्स्ट उत्पन्न करता है, जो प्रभावी रूप से टेक्स्ट-आधारित कॉज़ल डिस्कवरी एल्गोरिदम के बेंचमार्किंग के लिए ग्राउंड-ट्रुथ डेटा की कमी को दूर करता है।

Wenshuo Wang, Boyu Cao, Nan Zhuang, Wei Li2026-04-09