💬 NLP

ResonatorLM: Causal Resonant Field Mixing for Efficient Long-Context Language Modelin

यह शोधपत्र ResonatorLM को प्रस्तुत करता है, जो एक नवीन आर्किटेक्चर है जो मानक ट्रांसफॉर्मर की तुलना में लॉन्ग-कॉन्टेक्स्ट लैंग्वेज मॉडलिंग में महत्वपूर्ण गति और बेहतर सटीकता प्राप्त करने के लिए सेल्फ-अटेंशन को भौतिकी-व्युत्पन्न कॉज़ल रेज़ोनेटर फंक्शन्स (physics-derived causal resonator functions) से बदल देता है।

Archie Chaudhury2026-07-08
💬 NLP

BaFCo: A Document Understanding Benchmark for Complex Bangla Form Comprehension

यह शोधपत्र BaFCo को प्रस्तुत करता है, जो कि 200 जटिल बांग्ला सरकारी फॉर्मों का एक सूक्ष्म-एनोटेटेड (fine-grained annotated) बेंचमार्क डेटासेट है, जिसका उद्देश्य बांग्ला दस्तावेज़ लेआउट विश्लेषण और मुख्य सूचना निष्कर्षण में मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स की वर्तमान सीमाओं का मूल्यांकन करना और उन्हें उजागर करना है।

Abu Tyeb Azad, Ishita Sur Apan, Fahim Ahmed, Sumaiya Karim Katha, Ezharuddin Jubaer, Armun Alam, Pranjal Kumar Nandi, Am (…)2026-07-08
💬 NLP

NAVER LABS System Re-implementation for the IWSLT 2026 Instruction-Following Task

यह शोध पत्र 2026 के शेयर्ड टास्क के लिए NAVER LABS IWSHLT 2025 इंस्ट्रक्शन-फॉलोइंग पाइपलाइन के एक पुन: कार्यान्वयन को प्रस्तुत करता है, जिसे अनिवार्य SeamlessM4T-v2-large और Qwen3-4B-Instruct घटकों के साथ अनुकूलित किया गया है और स्पीच ट्रांसलेशन एवं स्पोकन क्वेश्चन आंसरिंग बेंचमार्क पर मजबूत प्रदर्शन प्राप्त करने के लिए 100k सिंथेटिक प्रशिक्षण उदाहरणों को पेश किया गया है।

Anand Kamble, Aniket Tathe2026-07-08
💬 NLP

Population-Level Profiling of DSM-5 Depressive Symptoms Among Self-Reported ADHD and ASD Users on Twitter: An Exploratory Study Using Advanced NLP and Statistical Analysis

इस अन्वेषणात्मक अध्ययन ने उन्नत एनएलपी (NLP) का उपयोग करके स्वयं-घोषित एडीएचडी (ADHD) और एडीएसडी (ASD) उपयोगकर्ताओं के 1.2 मिलियन से अधिक ट्वीट्स का विश्लेषण किया ताकि DSM-5 अवसादग्रस्त लक्षणों की अभिव्यक्ति में जनसंख्या-स्तरीय अंतरों की पहचान की जा सके, जिसमें संज्ञानात्मक समस्याओं और आत्महत्या के विचारों जैसे विशिष्ट लक्षणों में मामूली लेकिन सुसंगत अंतर पाया गया, जबकि यह भी नोट किया गया कि समग्र लक्षण सह-अस्तित्व संरचना दोनों समूहों के बीच काफी हद तक साझा रही।

Muhammad Rizwan, David Nabergoj, Jure Demšar2026-07-08
💬 NLP

RPAM: A Principled Metric for Evaluating Associations in Language Models with High Predictive Validity in Downstream Outputs

यह शोध पत्र रिलेटिव प्रोबेबिलिटी एसोसिएशन मेट्रिक (RPAM) को प्रस्तुत करता है, जो जनरेटिव लैंग्वेज मॉडल्स के लिए एक अपस्ट्रीम मूल्यांकन पद्धति है, जो विविध मॉडल्स और डेटासेट्स में मानव-समान जुड़ावों और डाउनस्ट्रीम बायस मेट्रिक्स दोनों के लिए मजबूत प्रेडिक्टिव वैलिडिटी प्रदर्शित करता है, तथा मौजूदा दृष्टिकोणों की सामान्यीकरण सीमाओं को संबोधित करता है।

Damian Hodel, Jevin West, Aylin Caliskan2026-07-08
💬 NLP

UCSC NLP at SemEval-2026 Task 10: Boundary-Aware Span Extraction and RoBERTa Classification for Conspiracy Detection

UCSC NLP टीम के SemEval-2026 टास्क 10 (PsyCoMark) के लिए सिस्टम्स, षड्यंत्र के संकेतों और दस्तावेजों का पता लगाने के लिए हार्ड-नेगेटिव सैंपलिंग के साथ बाउंड्री-अवेयर स्पैन एक्सट्रैक्शन और RoBERTa-आधारित वर्गीकरण का उपयोग करते हैं, जिससे क्रमशः 7वें और 11वें स्थान की रैंकिंग प्राप्त हुई और एंटिटी-जैसे भूमिकाओं बनाम अमूर्त भूमिका सीमाओं में संवेदनशीलता के विरुद्ध मजबूत पहचान को रेखांकित किया गया।

Dom Marhoefer, Milos Suvakovic, Glenn Grant-Richards, Aidan Pinero, Ryan King2026-07-08
🤖 AI

Memory in the Loop: In-Process Retrieval as ExtendedWorking Memory for Language Agents

यह शोध पत्र यह तर्क देता है कि मेमोरी रिट्रीवल (स्मृति पुनर्प्राप्ति) को एक धीमे, बाहरी नेटवर्क स्टोर से हटाकर एक तेज़, इन-प्रोसेस स्टोर में स्थानांतरित करना इसे भाषा एजेंटों के लिए प्रभावी विस्तारित वर्किंग मेमोरी (extended working memory) में बदल देता है, जिससे उस लेटेंसी-प्रेरित प्रदर्शन गिरावट को समाप्त किया जा सकता है जो वर्तमान में एजेंटों को प्रति टर्न केवल एक बार रिट्रीवल तक सीमित करने के लिए मजबूर करती है।

Yusuf Khan, Carlo Lipizzi2026-07-08
💬 NLP

Where to cut, how deep: BPE and Unigram-LM on chemistry SMILES

यह अध्ययन प्रदर्शित करता है कि बाइट-पेयर एनकोडिंग (BPE) और यूनिग्राम-LM रासायनिक SMILES के लिए मौलिक रूप से भिन्न और लगभग विलग (near-disjoint) सबवर्ड वोकैबुलरी (subword vocabularies) उत्पन्न करते हैं, जो यह दर्शाता है कि टोकेनाइजेशन एल्गोरिदम का चयन एक महत्वपूर्ण मॉडलिंग निर्णय है न कि एक तटस्थ डिफ़ॉल्ट।

Hunter Heidenreich2026-07-08
💬 NLP

SpanUQ: Span-Level Uncertainty Quantification for Large Language Model Generation

यह शोध पत्र SPANUQ को प्रस्तुत करता है, जो एक हल्का (lightweight) ढांचा है जो एक DETR-शैली के डिकोडर का उपयोग करके टोकन- और अनुक्रम-स्तर (sequence-level) की अनिश्चितता अनुमान की सीमाओं को संबोधित करता है ताकि अर्थपूर्ण रूप से सुसंगत टेक्स्ट स्पैन का पता लगाया जा सके और 'Mixture of Beta distribution' के माध्यम से उनकी अनिश्चितता को मापा जा सके, जिससे कई लार्ज लैंग्वेज मॉडल्स में बेहतर त्रुटि स्थानीयकरण (error localization) और दक्षता प्राप्त होती है।

Yimeng Zhang, Yingying Zhuang, Ziyi Wang, Yuxuan Lu, Pei Chen, Aman Gupta, Zhe Su, Ming Tan, Zhilin Zhang, Qun Liu, Mani (…)2026-07-08
💬 NLP

Nemotron-Labs-Diffusion: A Tri-Mode Language Model Unifying Autoregressive, Diffusion, and Self-Speculation Decoding

यह शोध पत्र Nemotron-Labs-Diffusion को प्रस्तुत करता है, जो एक त्रि-मोड (tri-mode) भाषा मॉडल है जो विभिन्न मॉडल स्केल्स और परिनियोजन सेटिंग्स में इन विधियों की पूरक शक्तियों का लाभ उठाकर बेहतर थ्रूपुट और सटीकता प्राप्त करने के लिए एक ही आर्किटेक्चर के भीतर ऑटोरेग्रेसिव (autoregressive), डिफ्यूजन (diffusion) और सेल्फ-स्पेक्टुलेशन (self-speculation) डिकोडिंग को एकीकृत करता है।

Yonggan Fu, Lexington Whalen, Abhinav Garg, Chengyue Wu, Maksim Khadkevich, Nicolai Oswald, Enze Xie, Daniel Egert, Shar (…)2026-07-08