💬 NLP

Towards Explainable Adjudicative Variance: Quantifying Judicial Discretion via Gated Multi-Task Learning

यह शोध पत्र एक पैरामीटर-कुशल, व्याख्या योग्य जज-अवेयर गेटेड मल्टी-टास्क लर्निंग आर्किटेक्चर प्रस्तावित करता है जो एक सूक्ष्म वर्गीकरण और गेटेड फ्यूजन तंत्र के माध्यम से तथ्यात्मक मामले के गुणों को न्यायिक विवेक से स्पष्ट रूप से अलग करके, यूके एम्प्लॉयमेंट ट्रिब्यूनल के परिणामों की भविष्यवाणी करने में बड़े पैमाने के जनरेटिव बेसलाइन से बेहतर प्रदर्शन करता है।

Stanisław Sójka, Felix Steffek, Matthias Grabmair2026-06-26
💬 NLP

The Riddle Riddle: Testing Flexible Reasoning in Large Language Models and Humans

यह शोध पत्र "रिडल रिडल" (riddle riddle) प्रतिमान को प्रस्तुत करता है ताकि यह प्रदर्शित किया जा सके कि जहाँ मनुष्य समस्या की सामग्री के अनुसार अपनी तर्क रणनीतियों को लचीले ढंग से अनुकूलित करते हैं, वहीं बड़े भाषा मॉडल अक्सर पैटर्न मिलान और सतही विशेषताओं पर निर्भर होते हैं, जिससे वे शाब्दिक समस्याओं पर भी अनुचित रूप से आविष्कारशील तर्क लागू कर देते हैं और यह सुझाव देते हैं कि वास्तविक पहेलियों पर उनका मजबूत प्रदर्शन स्मृति पुनर्प्राप्ति के बजाय लचीले तर्क से उत्पन्न हो सकता है।

Bella Fascendini, Kathryn McGregor, Max D. Gupta, Thomas L. Griffiths2026-06-26
💬 NLP

Forecasting With LLMs: Improved Generalization Through Feature Steering

यह शोध पत्र यह प्रदर्शित करता है कि पूर्वानुमान कार्यों में 'लुक-अहेड बायस' (look-ahead bias) को कम करने और ऐतिहासिक पैटर्न के आधार पर मॉडल की सामान्यीकरण क्षमता में सुधार करने के लिए, एलएलएम (LLMs) में समय-जागरूक विशेषताओं (time-aware features) को पहचानने और उन्हें प्रवर्धित करने हेतु स्पार्स ऑटोएनकोडर (sparse autoencoders) का उपयोग करना, सामान्य तर्क प्रदर्शन को बनाए रखते हुए, कार्यक्षम रूप से इसे कम कर सकता है।

Humzah Merchant, Bradford Levy2026-06-26
💬 NLP

Compositionality and the lexicon in evolutionary semantics

यह शोध पत्र एक विकासवादी ढांचे को प्रस्तुत करता है जो शाब्दिक अर्थों और संयोजन फलनों (composition functions) के सह-विकास को मॉडल करके औपचारिक अर्थविज्ञान को एकीकृत करता है, यह प्रदर्शित करते हुए कि संरक्षणशीलता (conservativity) का अर्थ संबंधी सार्वभौमिकता कैसे वैचारिक सरलता और संचारत्मक सटीकता के बीच संतुलन बनाने वाले एक कुशल प्रणाली-व्यापी अमूर्तता के रूप में उभरता है।

Fausto Carcassi2026-06-26
💬 NLP

CARVE: Content-Aware Recurrent with Value Efficiency for Chunk-Parallel Linear Attention

CARVE एक कंटेंट-अवेयर रिकरेंट आर्किटेक्चर है जो इरेज़ ऑपरेशन्स को की एक्सिस (key axis) तक सीमित करके प्रमुख डेल्टा-रूल मॉडल्स के मुख्य दोषों को हल करता है, जिससे कम पैरामीटर्स और मेमोरी उपयोग के साथ परप्लेक्सिटी, रीजनिंग और रिट्रीवल में स्टेट-ऑफ-द-आर्ट प्रदर्शन प्राप्त करते हुए कुशल WY-फॉर्म चंक-पैरेलल ट्रेनिंग सक्षम होती है।

Sayak Dutta2026-06-26
💬 NLP

LMs as Task-Specific Knowledge Bases: An Interpretability Analysis

यह शोध पत्र व्यवहारिक और यांत्रिक विश्लेषणों के माध्यम से इस दृष्टिकोण को चुनौती देता है कि भाषा मॉडल एकीकृत ज्ञान आधार हैं, जो यह प्रदर्शित करता है कि तथ्यात्मक ज्ञान एक कार्य-विशिष्ट तरीके से एनकोडेड होता है, जहाँ क्वेरी संदर्भ के आधार पर विशिष्ट पैरामीटर उपसमुच्चय सक्रिय होते हैं, जिससे तथ्यात्मक पुनर्प्राप्ति की निरंतरता और विश्वसनीयता बाधित होती है।

Amit Elhelo, Amir Globerson, Mor Geva2026-06-26
📊 statistics

The Geometry of Updates: Fisher Alignment at Vocabulary Scale

यह शोध पत्र FisherSketch प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त (training-free), स्ट्रीमिंग-कुशल विधि है जो साझा शब्दावली वाले LLM परिवारों के लिए स्केलेबल स्रोत चयन और कार्य समानता निदान (task similarity diagnostics) को सक्षम करने हेतु कर्नेल मीन एम्बेडिंग्स (kernel mean embeddings) के माध्यम से हेड फिशर संरेखण (head Fisher alignment) का अनुमान लगाता है, जो केवल प्रतिनिधित्व-आधारित मेट्रिक्स की सीमाओं और पूर्ण फिशर मैट्रिसेस की कम्प्यूटेशनल लागत पर विजय प्राप्त करता है।

John Sweeney2026-06-26
💬 NLP

How Surprising Is Historical Italian to Language Models? Tokenization Tax, Comprehension Tax, and a Simple Mitigation

यह शोध पत्र एक नैदानिक ढांचे का प्रस्ताव करता है जो ऐतिहासिक इतालवी में टोकनाइज़ेशन लागत को अर्थ संबंधी बोध से अलग करता है, जिससे यह स्पष्ट होता है कि जबकि 17वीं शताब्दी के ग्रंथों में मजबूत एम्बेडिंग समानता के बावजूद उच्च भविष्य कहनेवाला अनिश्चितता होती है, इस जनरेटिव अस्थिरता को सरल टेम्पोरल कॉन्टेक्स्ट प्रॉम्प्टिंग के माध्यम से लगभग 60% तक प्रभावी ढंग से कम किया जा सकता है।

Maria Levchenko2026-06-26
💬 NLP

Multilingual Reasoning Cascades Need More Context

यह शोध पत्र एक प्रशिक्षण-मुक्त, संदर्भ-जागरूक अनुवाद कैस्केड (translation cascade) का प्रस्ताव और सत्यापन करता है जो तर्क प्रक्रिया (reasoning pipeline) के दौरान मूल उपयोगकर्ता प्रश्न को सुरक्षित रखता है, और मानक बहुभाषी तर्क दृष्टिकोणों में निहित सूचना की हानि और त्रुटि प्रसार को कम करके विविध भाषाओं और कार्यों में महत्वपूर्ण प्रदर्शन लाभ प्रदर्शित करता है।

Arnav Mazumder, Dengjia Zhang, Shuyue Stella Li, Yulia Tsvetkov, Niyati Bafna2026-06-26
💬 NLP

Narrative Feature or Structured Feature? A Study of Large Language Models to Identify Cancer Patients at Risk of Heart Failure

यह अध्ययन प्रदर्शित करता है कि एक लार्ज लैंग्वेज मॉडल (GatorTron-3.9B), जो संरचित चिकित्सा कोडों से प्राप्त नवीन नैरेटिव विशेषताओं का उपयोग करता है, हृदय गति रुकने (हार्ट फेल्योर) के जोखिम वाले कैंसर रोगियों की पहचान करने में पारंपरिक मशीन लर्निंग और डीप लर्निंग मॉडलों की तुलना में काफी बेहतर प्रदर्शन करता है।

Ziyi Chen, Mengyuan Zhang, Mustafa Mohammed Ahmed, Yi Guo, Thomas J. George, Jiang Bian, Yonghui Wu2026-06-25