💬 NLP

When Simpler Is Better: Evaluating Translation Pipelines for Medieval Latin Manuscripts

यह शोध पत्र इंटरप्रेस-पैरेलल-कॉर्पस (Interpres-Parallel-Corpus) डेटासेट प्रस्तुत करता है और यह प्रदर्शित करता है कि मध्यकालीन लैटिन पांडुलिपियों के अनुवाद के लिए, एक विशेष ओसीआर (OCR) को विजन लैंग्वेज मॉडल (Vision Language Model) के साथ संयोजित करने वाला एक सरल पाइपलाइन, त्रुटि प्रसार (error propagation) और प्रॉम्प्ट संतृप्ति (prompt saturation) से बचकर अधिक जटिल बहु-घटक दृष्टिकोणों से बेहतर प्रदर्शन करता है।

Nguyen Kim Hai Bui, Md. Easin Arafat, Tamás Gábor Orosz, Mufti Mahmud2026-07-07
💬 NLP

Evaluating LLM Uncertainty in Long-Form Generation Using Deterministic Ground Truth

यह शोध पत्र SALT प्रस्तुत करता है, जो दीर्घ-रूप (long-form) LLM जनरेशन के मूल्यांकन के लिए नियत ग्राउंड ट्रुथ्स (deterministic ground truths) वाला एक बेंचमार्क है, जो यह प्रकट करता है कि जहाँ तर्क (reasoning) सटीकता में सुधार करता है, वहीं यह आत्मविश्वास रैंकिंग (confidence ranking) को कम करता है, और त्रुटि प्रसार (error propagation) भ्रष्ट प्रीफिक्स (corrupted prefixes) और बढ़ते उत्तर-संदर्भ लंबाई (answer-context length) दोनों से प्रेरित होता है।

Ido Amit, Ido Galil, Ran El-Yaniv2026-07-07
⚡ electrical engineering

Speaker-Disentangled Chunk-Wise Regression for Syllabic Tokenization

यह शोध पत्र अनसुपरवाइज्ड शब्दांश टोकेनाइजेशन (syllabic tokenization) के लिए एक स्पीकर-डिसेन्टैंगल्ड चंक-वाइज़ रिग्रेशन विधि प्रस्तावित करता है जो HuBERT-आधारित डिस्टिलेशन में स्पीकर आइडेंटिटी लीकेज पर विजय प्राप्त करता है, जिससे स्टेट-ऑफ-द-आर्ट शब्दांश डिटेक्शन प्राप्त होता है और डाउनस्ट्रीम स्पीच लैंग्वेज मॉडल के प्रदर्शन में महत्वपूर्ण सुधार होता है।

Ryota Komatsu, Kota Kawakita, Takuma Okamoto, Takahiro Shinozaki2026-07-07
⚡ electrical engineering

DuplexChat: Constructing Speaker-Separated Full-Duplex Dialogue Speech at Scale for Spoken Dialogue Language Modeling

यह शोधपत्र DuplexChat को प्रस्तुत करता है, जो अंग्रेजी और जापानी में वक्ता-पृथक फुल-डुप्लेक्स संवाद भाषण का एक बड़े पैमाने का ओपन-सोर्स कॉर्पस है, जिसे स्पोकन डायलॉग लैंग्वेज मॉडल्स के लिए उपयुक्त प्रशिक्षण डेटा की कमी को दूर करने हेतु सार्वजनिक पॉडकास्ट से DuplexChat-Pipe पाइपलाइन के माध्यम से निर्मित किया गया है।

Wataru Nakata, Yuki Saito, Hiroshi Saruwatari2026-07-07
📊 statistics

What Does a Discrete Diffusion Model Learn?

यह शोध पत्र यह सिद्ध करके कि नकारात्मक ELBO, डेटा एंट्रॉपी और एक पाथ KL डाइवर्जेंस के ठीक बराबर है, डिस्क्रीट डिफ्यूजन मॉडल्स के लिए एक कठोर सैद्धांतिक ढांचा स्थापित करता है, जिससे विभिन्न लॉस फंक्शन्स (जैसे कि डिनोइजिंग, स्कोर, और ब्रिज प्लग-इन) को एक एकल इष्टतम ओरेकल जंप रेट के कोऑर्डिनेट ट्रांसफॉर्मेशन के रूप में एकीकृत किया जा सके और इन दृष्टिकोणों के लिए सटीक विश्लेषणात्मक रूपांतरण और इनिशियलाइजेशन कैलिब्रेशन प्रदान किया जा सके।

Rodrigo Casado Noguerales, Bernhard Schölkopf, Thomas Hofmann, Aran Raoufi2026-07-07
💬 NLP

A validity-guided workflow for robust large language model research in psychology

बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) का उपयोग करने वाले मनोवैज्ञानिक अनुसंधान की वैधता को कमजोर करने वाले "मेज़रमेंट फैंटम्स" (मापन संबंधी भ्रमों) के खतरे को संबोधित करने के लिए, यह शोध पत्र एक छह-चरणीय, द्वि-वैधता ढांचे का प्रस्ताव करता है जो अनुसंधान लक्ष्यों के अनुरूप कठोर साइकोमेट्रिक और कारण संबंधी सत्यापन आवश्यकताओं को स्केल करता है, जिससे एआई मनोविज्ञान के लिए मजबूत अनुभवजन्य आधार सुनिश्चित होता है।

Zhicheng Lin2026-07-03
💬 NLP

Sri Lanka Document Datasets: A Large-Scale, Multilingual Resource for Law, News, and Policy

यह शोध पत्र एक बड़े पैमाने के, बहुभाषी खुले डेटासेट संग्रह को प्रस्तुत करता है जिसमें सिंहल, तमिल और अंग्रेजी में 278,000 से अधिक दस्तावेज़ शामिल हैं, जो कम्प्यूटेशनल भाषाविज्ञान और सामाजिक-राजनीतिक अध्ययन में अनुसंधान का समर्थन करने के लिए श्रीलंकाई कानून, समाचार और नीति को कवर करते हैं।

Nuwan I. Senaratna2026-07-03
💬 NLP

Psychological Imagination Networks Show Cross-Population Centrality and Clustering Alignment in Humans That Large Language Models Fail to Replicate

यह अध्ययन प्रदर्शित करता है कि जहाँ मानव मानसिक कल्पना नेटवर्क केंद्रीयता (centrality) और क्लस्टरिंग (clustering) में सुदृढ़ क्रॉस-पॉपुलेशन संरचनात्मक संरेखण प्रदर्शित करते हैं, वहीं लार्ज लैंग्वेज मॉडल्स इन पैटर्नों को दोहराने में विफल रहते हैं, जो यह सुझाव देता है कि मानव कल्पना केवल भाषाई प्रशिक्षण के बजाय मूर्त अनुभवात्मक स्मृति (embodied experiential memory) पर निर्भर करती है।

Saurabh Ranjan, Brian Odegaard2026-07-03
💬 NLP

Psychological Steering in LLMs: An Evaluation of Effectiveness and Trustworthiness

यह शोध पत्र PsySET को प्रस्तुत करता है, जो LLMs की भावनाओं और व्यक्तित्वों को नियंत्रित करने के लिए विभिन्न स्टीयरिंग रणनीतियों की प्रभावशीलता और विश्वसनीयता का मूल्यांकन करने वाला एक नवीन बेंचमार्क है, जो यह प्रकट करता है कि जबकि वेक्टर इंजेक्शन जैसी विधियाँ सूक्ष्म नियंत्रण प्रदान करती हैं, वे विशिष्ट गुणों के आधार पर तथ्यात्मक सुदृढ़ता में कमी या विषाक्तता में वृद्धि जैसे जटिल दुष्प्रभाव भी उत्पन्न कर सकती हैं।

Amin Banayeeanzade, Ala N. Tak, Fatemeh Bahrani, Anahita Bolourani, Leonardo Blas, Emilio Ferrara, Jonathan Gratch, Sai (…)2026-07-03
💬 NLP

CreativityPrism: A Cross-Domain Evaluation Framework for Large Language Model Creativity

यह शोध पत्र CreativityPrism को प्रस्तुत करता है, जो एक स्केलेबल, क्रॉस-डोमेन मूल्यांकन ढांचा है जो तीन आयामों (गुणवत्ता, नवीनता और विविधता) का उपयोग करके डाइवर्जेंट थिंकिंग (अपसारी चिंतन), रचनात्मक लेखन और तार्किक तर्क के आठ कार्यों में लार्ज लैंग्वेज मॉडल्स का आकलन करता है, जिससे यह पता चलता है कि जबकि फ्रंटियर मॉडल्स लेखन और तर्क में उत्कृष्ट हैं, वे डाइवर्जेंट थिंकिंग में कोई महत्वपूर्ण लाभ नहीं दिखाते हैं और प्रदर्शन शायद ही कभी विभिन्न रचनात्मक आयामों में सामान्यीकृत होता है।

Zhaoyi Joey Hou, Bowei Alvin Zhang, Yining Lu, Bhiman Kumar Baghel, Anneliese Brei, Ximing Lu, Meng Jiang, Faeze Brahman (…)2026-07-03