💬 NLP

Click it or Leave it: Detecting and Spoiling Clickbait with Informativeness Measures and Large Language Models

यह शोधपत्र एक हाइब्रिड क्लिकबेट डिटेक्शन मॉडल प्रस्तुत करता है जो ट्रांसफॉर्मर-आधारित एम्बेडिंग्स को 15 भाषाई रूप से प्रेरित सूचनात्मक विशेषताओं के साथ जोड़ता है, जिससे XGBoost के साथ 91% F1-स्कोर प्राप्त होता है और महत्वपूर्ण भाषाई संकेतों के माध्यम से भविष्यवाणी की व्याख्यात्मकता में वृद्धि होती है।

Wojciech Michaluk, Tymoteusz Urban, Mateusz Kubita, Soveatin Kuntur, Anna Wroblewska2026-02-23
💬 NLP

Information-Theoretic Storage Cost in Sentence Comprehension

यह शोध पत्र वाक्य बोध में वर्किंग मेमोरी लोड को मापने के लिए न्यूरल लैंग्वेज मॉडल्स से व्युत्पन्न एक निरंतर, सिद्धांत-तटस्थ, सूचना-सैद्धांतिक स्टोरेज लागत का प्रस्ताव करता है, जो ज्ञात प्रोसेसिंग विषमताओं को सफलतापूर्वक पुनः प्राप्त करके, पारंपरिक व्याकरण-आधारित मेट्रिक्स के साथ सहसंबंध स्थापित करके और बड़े पैमाने पर प्राकृतिक डेटासेट में रीडिंग टाइम की भविष्यवाणी करके अपनी वैधता प्रदर्शित करता है।

Kohei Kajikawa, Shinnosuke Isono, Ethan Gotlieb Wilcox2026-02-23
💬 NLP

Simplifying Outcomes of Language Model Component Analyses with ELIA

यह शोध पत्र ELIA को प्रस्तुत करता है, जो एक संवादात्मक वेब एप्लिकेशन है जो उन्नत विश्लेषण तकनीकों को AI-जनित प्राकृतिक भाषा स्पष्टीकरणों के साथ एकीकृत करके मैकेनिस्टिक इंटरप्रिटेबिलिटी (mechanistic interpretability) में सुलभता के अंतर को पाटता है, जिससे गैर-विशेषज्ञों को एक उपयोगकर्ता-केंद्रित, खोजपूर्ण इंटरफ़ेस के माध्यम से जटिल भाषा मॉडल घटकों को प्रभावी ढंग से समझने में सक्षम बनाया जा सके।

Aaron Louis Eidt, Nils Feldhus2026-02-23
💬 NLP

Analyzing and Improving Chain-of-Thought Monitorability Through Information Theory

यह शोध पत्र चेन-ऑफ-थॉट (CoT) मॉनिटर क्षमता की सीमाओं को पहचानने के लिए सूचना सिद्धांत (information theory) का उपयोग करता है, और दो प्रशिक्षण विधियों—ओरेकल-आधारित (oracle-based) और लेबल-मुक्त म्यूचुअल इंफॉर्मेशन मैक्सिमाइजेशन (label-free mutual information maximization)—का प्रस्ताव करता है जो व्यवस्थित रूप से CoT डिजनरेशन को रोकते हुए और रिवॉर्ड हैकिंग को कम करते हुए मॉनिटर सटीकता में सुधार करते हैं।

Usman Anwar, Tim Bakker, Dana Kianfar, Cristina Pinneri, Christos Louizos2026-02-23
💬 NLP

VeriSoftBench: Repository-Scale Formal Verification Benchmarks for Lean

यह शोधपत्र VeriSoftBench प्रस्तुत करता है, जो ओपन-सोर्स सॉफ्टवेयर वेरिफिकेशन प्रोजेक्ट्स से लीन 4 (Lean 4) के 500 प्रूफ ऑब्लिगेशन्स का एक रिपॉजिटरी-स्केल बेंचमार्क है, जो यह प्रकट करता है कि वर्तमान LLMs गणितीय से कोड-केंद्रित परिवेश में स्थानांतरित होने में संघर्ष करते हैं और प्रमाण स्वचालन (proof automation) की सफलता पर क्रॉस-फाइल डिपेंडेंसीज के महत्वपूर्ण प्रभाव को उजागर करता है।

Yutong Xin, Qiaochu Chen, Greg Durrett, Işil Dillig2026-02-23
💬 NLP

Vichara: Appellate Judgment Prediction and Explanation for the Indian Judicial System

विचार (Vichara) एक अभिनव ढांचा है जिसे केस दस्तावेजों को संरचित निर्णय बिंदुओं में विभाजित करके और IRAC-प्रेरित स्पष्टीकरण उत्पन्न करके भारतीय अपीलीय निर्णयों की भविष्यवाणी करने और उन्हें समझाने के लिए डिज़ाइन किया गया है, जो कई बड़े भाषा मॉडलों (large language models) में अत्याधुनिक प्रदर्शन और उच्च व्याख्यात्मकता प्राप्त करता है।

Pavithra PM Nair, Preethu Rose Anish2026-02-23
💬 NLP

Validating Political Position Predictions of Arguments

यह शोध पत्र पॉइंटवाइज़ (pointwise) और पेयरवाइज़ (pairwise) मानव एनोटेशन को संयोजित करने वाले एक द्वि-स्तरीय सत्यापन ढांचे को प्रस्तुत करता है जो भाषा मॉडलों द्वारा राजनीतिक रुख के पूर्वानुमानों को प्रभावी ढंग से मूल्यांकित करता है, यह प्रदर्शित करते हुए कि जबकि व्यक्तिगत भविष्यवाणियां व्यक्तिपरक होती हैं, उनसे प्राप्त क्रमिक रैंकिंग (ordinal rankings) मानव निर्णयों के साथ उच्च संरेखण प्राप्त करती है और राजनीतिक विमर्श के लिए एक बड़े पैमाने पर, सत्यापित तर्कसंगत ज्ञान आधार के निर्माण को सक्षम बनाती है।

Jordan Robinson, Angus R. Williams, Katie Atkinson, Anthony G. Cohn2026-02-23
💬 NLP

Subgroups of U(d)U(d) Induce Natural RNN and Transformer Architectures

यह शोध पत्र एक एकीकृत स्वयंसिद्ध ढांचे (axiomatic framework) का प्रस्ताव करता है जो U(d) के बंद उपसमूहों (closed subgroups) से पुनरावर्ती (recurrent) और ट्रांसफॉर्मर आर्किटेक्चर को व्युत्पन्न करता है, और भाषा मॉडलिंग कार्यों पर प्रयोगों के माध्यम से यह प्रदर्शित करता है कि रैखिक स्पर्श-स्थान मिश्रण (linear tangent-space mixing) वाले ऑर्थोगोनल अवस्था स्थानों (O(d)) का उपयोग करने वाले मॉडल पैरामीटर-मैच्ड सेटिंग्स के तहत प्रतिस्पर्धी प्रदर्शन प्राप्त करते हैं।

Joshua Nunley2026-02-23
💬 NLP

SPQ: An Ensemble Technique for Large Language Model Compression

यह शोध पत्र SPQ को प्रस्तुत करता है, जो एक एन्सेम्बल कंप्रेशन तकनीक है जो LLaMA-2-7B जैसे बड़े भाषा मॉडलों के लिए मेमोरी में महत्वपूर्ण कमी और बेहतर इन्फरेंस गति प्राप्त करने के लिए SVD, एक्टिवेशन-आधारित प्रूनिंग और पोस्ट-ट्रेनिंग क्वांटाइजेशन को तालमेल के साथ जोड़ता है, जबकि मौजूदा बेसलाइन की तुलना में उनकी परप्लेक्सिटी और डाउनस्ट्रीम टास्क सटीकता को बनाए रखता है या बढ़ाता है।

Jiamin Yao, Eren Gultepe2026-02-23
💬 NLP

RVR: Retrieve-Verify-Retrieve for Comprehensive Question Answering

यह शोध पत्र 'रिट्रीव-वेरिफाई-रिट्रीव' (RVR) को प्रस्तुत करता है, जो एक बहु-चरणीय ढांचा है जो व्यापक उत्तर कवरेज को अधिकतम करने के लिए सत्यापित दस्तावेज़ों के साथ प्रश्नों को पुनरावृत्ति से संवर्धित करता है, और विविध डेटासेट्स पर मौजूदा बेसलाइन की तुलना में रिकॉल (recall) में महत्वपूर्ण सुधार प्रदर्शित करता है।

Deniz Qian, Hung-Ting Chen, Eunsol Choi2026-02-23