💬 NLP

Information-Theoretic Storage Cost in Sentence Comprehension

यह शोध पत्र वाक्य बोध में वर्किंग मेमोरी लोड को मापने के लिए न्यूरल लैंग्वेज मॉडल्स से व्युत्पन्न एक निरंतर, सिद्धांत-तटस्थ, सूचना-सैद्धांतिक स्टोरेज लागत का प्रस्ताव करता है, जो ज्ञात प्रोसेसिंग विषमताओं को सफलतापूर्वक पुनः प्राप्त करके, पारंपरिक व्याकरण-आधारित मेट्रिक्स के साथ सहसंबंध स्थापित करके और बड़े पैमाने पर प्राकृतिक डेटासेट में रीडिंग टाइम की भविष्यवाणी करके अपनी वैधता प्रदर्शित करता है।

Kohei Kajikawa, Shinnosuke Isono, Ethan Gotlieb Wilcox2026-02-23
💬 NLP

Simplifying Outcomes of Language Model Component Analyses with ELIA

यह शोध पत्र ELIA को प्रस्तुत करता है, जो एक संवादात्मक वेब एप्लिकेशन है जो उन्नत विश्लेषण तकनीकों को AI-जनित प्राकृतिक भाषा स्पष्टीकरणों के साथ एकीकृत करके मैकेनिस्टिक इंटरप्रिटेबिलिटी (mechanistic interpretability) में सुलभता के अंतर को पाटता है, जिससे गैर-विशेषज्ञों को एक उपयोगकर्ता-केंद्रित, खोजपूर्ण इंटरफ़ेस के माध्यम से जटिल भाषा मॉडल घटकों को प्रभावी ढंग से समझने में सक्षम बनाया जा सके।

Aaron Louis Eidt, Nils Feldhus2026-02-23
💬 NLP

Analyzing and Improving Chain-of-Thought Monitorability Through Information Theory

यह शोध पत्र चेन-ऑफ-थॉट (CoT) मॉनिटर क्षमता की सीमाओं को पहचानने के लिए सूचना सिद्धांत (information theory) का उपयोग करता है, और दो प्रशिक्षण विधियों—ओरेकल-आधारित (oracle-based) और लेबल-मुक्त म्यूचुअल इंफॉर्मेशन मैक्सिमाइजेशन (label-free mutual information maximization)—का प्रस्ताव करता है जो व्यवस्थित रूप से CoT डिजनरेशन को रोकते हुए और रिवॉर्ड हैकिंग को कम करते हुए मॉनिटर सटीकता में सुधार करते हैं।

Usman Anwar, Tim Bakker, Dana Kianfar, Cristina Pinneri, Christos Louizos2026-02-23
💬 NLP

VeriSoftBench: Repository-Scale Formal Verification Benchmarks for Lean

यह शोधपत्र VeriSoftBench प्रस्तुत करता है, जो ओपन-सोर्स सॉफ्टवेयर वेरिफिकेशन प्रोजेक्ट्स से लीन 4 (Lean 4) के 500 प्रूफ ऑब्लिगेशन्स का एक रिपॉजिटरी-स्केल बेंचमार्क है, जो यह प्रकट करता है कि वर्तमान LLMs गणितीय से कोड-केंद्रित परिवेश में स्थानांतरित होने में संघर्ष करते हैं और प्रमाण स्वचालन (proof automation) की सफलता पर क्रॉस-फाइल डिपेंडेंसीज के महत्वपूर्ण प्रभाव को उजागर करता है।

Yutong Xin, Qiaochu Chen, Greg Durrett, Işil Dillig2026-02-23
💬 NLP

Vichara: Appellate Judgment Prediction and Explanation for the Indian Judicial System

विचार (Vichara) एक अभिनव ढांचा है जिसे केस दस्तावेजों को संरचित निर्णय बिंदुओं में विभाजित करके और IRAC-प्रेरित स्पष्टीकरण उत्पन्न करके भारतीय अपीलीय निर्णयों की भविष्यवाणी करने और उन्हें समझाने के लिए डिज़ाइन किया गया है, जो कई बड़े भाषा मॉडलों (large language models) में अत्याधुनिक प्रदर्शन और उच्च व्याख्यात्मकता प्राप्त करता है।

Pavithra PM Nair, Preethu Rose Anish2026-02-23
💬 NLP

Validating Political Position Predictions of Arguments

यह शोध पत्र पॉइंटवाइज़ (pointwise) और पेयरवाइज़ (pairwise) मानव एनोटेशन को संयोजित करने वाले एक द्वि-स्तरीय सत्यापन ढांचे को प्रस्तुत करता है जो भाषा मॉडलों द्वारा राजनीतिक रुख के पूर्वानुमानों को प्रभावी ढंग से मूल्यांकित करता है, यह प्रदर्शित करते हुए कि जबकि व्यक्तिगत भविष्यवाणियां व्यक्तिपरक होती हैं, उनसे प्राप्त क्रमिक रैंकिंग (ordinal rankings) मानव निर्णयों के साथ उच्च संरेखण प्राप्त करती है और राजनीतिक विमर्श के लिए एक बड़े पैमाने पर, सत्यापित तर्कसंगत ज्ञान आधार के निर्माण को सक्षम बनाती है।

Jordan Robinson, Angus R. Williams, Katie Atkinson, Anthony G. Cohn2026-02-23
💬 NLP

Subgroups of U(d)U(d) Induce Natural RNN and Transformer Architectures

यह शोध पत्र एक एकीकृत स्वयंसिद्ध ढांचे (axiomatic framework) का प्रस्ताव करता है जो U(d) के बंद उपसमूहों (closed subgroups) से पुनरावर्ती (recurrent) और ट्रांसफॉर्मर आर्किटेक्चर को व्युत्पन्न करता है, और भाषा मॉडलिंग कार्यों पर प्रयोगों के माध्यम से यह प्रदर्शित करता है कि रैखिक स्पर्श-स्थान मिश्रण (linear tangent-space mixing) वाले ऑर्थोगोनल अवस्था स्थानों (O(d)) का उपयोग करने वाले मॉडल पैरामीटर-मैच्ड सेटिंग्स के तहत प्रतिस्पर्धी प्रदर्शन प्राप्त करते हैं।

Joshua Nunley2026-02-23
💬 NLP

SPQ: An Ensemble Technique for Large Language Model Compression

यह शोध पत्र SPQ को प्रस्तुत करता है, जो एक एन्सेम्बल कंप्रेशन तकनीक है जो LLaMA-2-7B जैसे बड़े भाषा मॉडलों के लिए मेमोरी में महत्वपूर्ण कमी और बेहतर इन्फरेंस गति प्राप्त करने के लिए SVD, एक्टिवेशन-आधारित प्रूनिंग और पोस्ट-ट्रेनिंग क्वांटाइजेशन को तालमेल के साथ जोड़ता है, जबकि मौजूदा बेसलाइन की तुलना में उनकी परप्लेक्सिटी और डाउनस्ट्रीम टास्क सटीकता को बनाए रखता है या बढ़ाता है।

Jiamin Yao, Eren Gultepe2026-02-23
💬 NLP

RVR: Retrieve-Verify-Retrieve for Comprehensive Question Answering

यह शोध पत्र 'रिट्रीव-वेरिफाई-रिट्रीव' (RVR) को प्रस्तुत करता है, जो एक बहु-चरणीय ढांचा है जो व्यापक उत्तर कवरेज को अधिकतम करने के लिए सत्यापित दस्तावेज़ों के साथ प्रश्नों को पुनरावृत्ति से संवर्धित करता है, और विविध डेटासेट्स पर मौजूदा बेसलाइन की तुलना में रिकॉल (recall) में महत्वपूर्ण सुधार प्रदर्शित करता है।

Deniz Qian, Hung-Ting Chen, Eunsol Choi2026-02-23
💬 NLP

The distribution of discourse relations within and across turns in spontaneous conversation

यह अध्ययन क्राउडसोर्स्ड एनोटेशन का उपयोग करके सहज संवाद के लिए एक लिखित-भाषा विमर्श संबंध प्रणाली (discourse relation system) को अनुकूलित करता है ताकि यह प्रदर्शित किया जा सके कि विमर्श संबंधों का वितरण विभिन्न संवादात्मक संदर्भों में महत्वपूर्ण रूप से भिन्न होता है, जिसमें एकल-टर्न एनोटेशन सर्वाधिक अनिश्चितता प्रस्तुत करते हैं, जबकि यह भी पुष्टि की जाती है कि ये एनोटेशन विमर्श इकाई एम्बेडिंग (discourse unit embeddings) से अनुमान लगाने के लिए पर्याप्त गुणवत्ता के हैं।

S. Magalí López Cortez, Cassandra L. Jacobs2026-02-20