💬 NLP

Low-Latency Real-Time Audio Game Commentary System via LLM-Based Parallel Text Generation

यह शोध पत्र एक कम-विलंबता वाले वास्तविक समय के ऑडियो गेम कमेंट्री सिस्टम को प्रस्तुत करता है जो स्पीच प्लेबैक के समानांतर टेक्स्ट जनरेशन चलाने और संभावित कथनों (कैंडिडेट अटरेंस) को बफर करने के माध्यम से अनुक्रमिक पाइपलाइन बाधाओं को दूर करता है, जिससे इंटर-अटरेंस साइलेंस (कथनों के बीच का मौन) 9.6 से घटकर 0.3 सेकंड हो जाता है और कमेंट्री की लय की कथित स्वाभाविकता में महत्वपूर्ण सुधार होता है।

Ryota Kawamatsu, Anum Afzal, Yuki Saito, Shinnosuke Takamichi, Graham Neubig, Katsuhito Sudoh, Hiroya Takamura, Tatsuya (…)2026-06-12
🤖 AI

Why Sampling Is Not Choosing: Intentionality, Agency, and Moral Responsibility in Large Language Models

यह शोधपत्र तर्क देता है कि लार्ज लैंग्वेज मॉडल्स को नैतिक एजेंट नहीं माना जा सकता क्योंकि उनके संभाव्य, डेटा-संचालित आउटपुट में आंतरिक इरादा, स्व-आरोपित प्रतिबद्धता और वास्तविक विकल्प का अभाव होता है जो नैतिक उत्तरदायित्व के लिए आवश्यक है, चाहे उनकी मानकीय रूप से मूल्यांकनीय पाठ उत्पन्न करने की क्षमता कुछ भी हो।

Joseph Keshet2026-06-12
💬 NLP

Examining the Cognitive Gap Between Authors and Peer Reviewers on Academic Paper Novelty

*Nature Communications* के 15,328 शोध पत्रों और उनकी सहकर्मी समीक्षाओं (peer reviews) का विश्लेषण करते हुए, यह अध्ययन प्रकट करता है कि हालांकि लेखक और समीक्षक दोनों ही परिणाम-उन्मुख नवाचार को प्राथमिकता देते हैं, सकारात्मक नवीनता मूल्यांकन प्राप्त करने में प्रचार संबंधी भाषा की प्रभावशीलता एक शोध पत्र की वास्तविक नवीनता पर निर्भर करती है, जो विशेष रूप से मध्यम नवीनता वाले शोध पत्रों के लिए सबसे मजबूत प्रभाव और समीक्षक असहमति की संभावना दर्शाती है।

Chenggang Yang, Chengzhi Zhang2026-06-12
💬 NLP

SupraBench: A Benchmark for Supramolecular Chemistry

यह शोध पत्र SupraBench प्रस्तुत करता है, जो बाइंडिंग एफिनिटी प्रेडिक्शन और होस्ट-गेस्ट रीजनिंग जैसे मौलिक सुप्रामोलिकुलर केमिस्ट्री कार्यों पर लार्ज लैंग्वेज मॉडल्स का मूल्यांकन करने के लिए डिज़ाइन किया गया पहला बेंचमार्क है, साथ ही डोमेन एडाप्टेशन में सहायता के लिए एक विशेष 16M-टोकन कॉर्पस (SupraPMC) भी जारी करता है।

Tianyi Ma, Yijun Ma, Zehong Wang, Weixiang Sun, Ziming Li, Connor R. Schmidt, Chuxu Zhang, Matthew J. Webber, Yanfang Ye2026-06-12
💬 NLP

When Does Mixing Help? Analyzing Query Embedding Interpolation in Multilingual Dense Retrieval

यह शोध पत्र प्रदर्शित करता है कि बहुभाषी प्रश्नों का एम्बेडिंग-स्तर पर इंटरपोलेशन अनुमानित प्रतिधारण लाभ (retrieval gains) प्रदान करता है, जो यह प्रकट करता है कि मिश्रण गैर-अंग्रेजी दस्तावेज़ अनुक्रमणों (indices) के लिए सार्वभौमिक रूप से लाभकारी है लेकिन अंग्रेजी-प्रधान अनुक्रमणों के लिए प्रतिकूल है, और इष्टतम प्रदर्शन एक मिश्रण भागीदार के रूप में अंग्रेजी द्वारा संचालित होता है तथा टाइपोलॉजिकल दूरी (typological distance) के साथ नकारात्मक रूप से सह-संबंधित है।

Tongyao Zhu, Chao-Ming Huang, Min-Yen Kan2026-06-12
🤖 AI

Uncertainty-Aware Hybrid Retrieval for Long-Document RAG

यह शोध पत्र UMG-RAG का प्रस्ताव करता है, जो एक प्रशिक्षण-मुक्त (training-free) हाइब्रिड रिट्रीवल फ्रेमवर्क है जो अनिश्चितता अनुमान (uncertainty estimation) के आधार पर कई चंक ग्रैनुलैरिटीज़ से साक्ष्य को गतिशील रूप से संलयित (fuse) करता है और मौजूदा रिट्रीवर्स या जनरेटर्स को संशोधित किए बिना लॉन्ग-डॉक्यूमेंट RAG प्रदर्शन को बढ़ाने के लिए एक पैरेंट प्रमोशन वेरिएंट (UMGP-RAG) पेश करता है।

Hoin Jung, Xiaoqian Wang2026-06-12
💬 NLP

Edit the Bits, Diff the Codes: Bitwise Residual Editing for Visual Autoregressive Models

यह शोधपत्र BitResEdit का प्रस्ताव करता है, जो विजुअल ऑटोरेग्रेसिव मॉडल्स के लिए एक ट्रेनिंग-फ्री फ्रेमवर्क है जो इमेज एडिटिंग कार्यों में बेहतर टेक्स्ट अलाइनमेंट और बैकग्राउंड प्रिजर्वेशन प्राप्त करने के लिए BitEdit के बिटवाइज लॉग-ऑड्स गाइडेंस और ResEdit के स्केल-अवेयर रेसिडुअल कोड कंपोजिशन को जोड़ता है।

Shengqiang Zhang, Ruotong Liao, Volker Tresp, Barbara Plank, Hinrich Schütze2026-06-12
💬 NLP

ArogyaSutra: A Multi-Agent Framework for Multimodal Medical Reasoning in Indic Languages

यह शोध पत्र आरोग्यसूत्र (ArogyaSutra) को प्रस्तुत करता है, जो एक मल्टी-एजेंट फ्रेमवर्क और एक बड़े पैमाने का बहुभाषी बहुआयामी चिकित्सा डेटासेट है जिसे टूल ग्राउंडिंग, ड्यूल-मेमोरी तंत्र और एक्टर-क्रिटिक डिस्टिलेशन को एकीकृत करके कम-संसाधन वाले भारतीय भाषाओं में एआई-संचालित स्वास्थ्य सेवा तर्क को बढ़ाने के लिए डिज़ाइन किया गया है।

Tanmoy Kanti Halder, Akash Ghosh, Subhadip Baidya, Arijit Roy, Sriparna Saha2026-06-12
💬 NLP

Beyond the Commitment Boundary: Probing Epiphenomenal Chain-of-Thought in Large Reasoning Models

यह शोध पत्र बड़े रीजनिंग मॉडलों में एक "कमिटमेंट बाउंड्री" (commitment boundary) की पहचान करता है जहाँ अंतिम उत्तर पहले ही निर्धारित हो जाता है, जिससे यह स्पष्ट होता है कि बाद के चेन-ऑफ-थॉट (chain-of-thought) चरण काफी हद तक एपिफेनोमेनल (epiphenomenal) होते हैं और प्रदर्शन से समझौता किए बिना रीजनिंग की लंबाई को 55% तक कम करने के लिए उन्हें सुरक्षित रूप से छोड़ा जा सकता है।

Daniel Scalena, Sara Candussio, Luca Bortolussi, Elisabetta Fersini, Malvina Nissim, Gabriele Sarti2026-06-12
💬 NLP

Beyond Uniform Tokens: Adaptive Compression for Time Series Language Models

यह शोध पत्र एक अनुकूली टोकन संपीड़न ढांचे (adaptive token compression framework) का प्रस्ताव करता है जो समय श्रृंखला भाषा मॉडलों (time series language models) के लिए, महत्वपूर्ण अनुमान त्वरण और प्रदर्शन सुधार प्राप्त करने हेतु समय श्रृंखला डेटा के विशिष्ट स्पेक्ट्रल गुणों और परतों के माध्यम से प्रॉम्प्ट्स के घटते प्रभाव का लाभ उठाता है।

Jialin Gan, Xin Qiu, Guangzhe Chen, Xue Wang2026-06-12