💬 NLP

The Moral Foundations Reddit Corpus

यह शोध पत्र 'मोरल फाउंडेशन्स रेडिट कॉर्पस' (Moral Foundations Reddit Corpus) का परिचय देता है, जो अपडेटेड 'मोरल फाउंडेशन थ्योरी' पर आधारित आठ नैतिक भावना श्रेणियों को कवर करने वाले 16,123 रेडिट कमेंट्स का एक हस्त-एनोटेटेड (hand-annotated) डेटासेट है, और बेंचमार्किंग के माध्यम से यह प्रदर्शित करता है कि फाइन-ट्यून किए गए एनकोडर मॉडल वर्तमान में नैतिक भावना का पता लगाने में लार्ज लैंग्वेज मॉडल्स से बेहतर प्रदर्शन करते हैं, जो एआई अलाइनमेंट (AI alignment) के लिए मानव-एनोटेटेड डेटा की निरंतर आवश्यकता को रेखांकित करता है।

Jackson Trager, Alireza S. Ziabari, Elnaz Rahmati, Aida Mostafazadeh Davani, Preni Golazizian, Farzan Karimi-Malekabadi (…)2026-03-19
💬 NLP

Automated stance detection in complex topics and small languages: the challenging case of immigration in polarizing news media

यह शोध पत्र प्रदर्शित करता है कि कैसे सुपरवाइज्ड लैंग्वेज मॉडल्स और चैटजीपीटी (ChatGPT) दोनों ही अप्रवास के संबंध में जटिल, कम-संसाधन वाली एस्टोनियाई भाषा पर स्वचालित रुख का पता लगाने (automated stance detection) को प्रभावी ढंग से निष्पादित कर सकते हैं, जिससे ध्रुवीकृत समाचार मीडिया में कालानुक्रमिक रुझानों (diachronic trends) का विश्लेषण संभव हो पाता है।

Mark Mets, Andres Karjus, Indrek Ibrus, Maximilian Schich2026-03-19
💬 NLP

Multilingual LLMs Struggle to Link Orthography and Semantics in Bilingual Word Processing

यह अध्ययन प्रकट करता है कि जहाँ बहुभाषी लार्ज लैंग्वेज मॉडल्स (LLMs) कॉग्नेट्स (cognates) और नॉन-कॉग्नेट्स (non-cognates) को प्रभावी ढंग से संसाधित करते हैं, वहीं वे इंटरलिंगुअल होमोग्राफ्स (interlingual homographs) के साथ काफी संघर्ष करते हैं क्योंकि वे अर्थ संबंधी समझ के बजाय वर्तनी संबंधी समानताओं पर निर्भर रहते हैं, और अक्सर वाक्य के संदर्भ के भीतर भी अर्थों का स्पष्टीकरण करने में विफल रहते हैं।

Eshaan Tanwar, Gayatri Oke, Tanmoy Chakraborty2026-03-19
💬 NLP

Byte-token Enhanced Language Models for Temporal Point Processes Analysis

यह शोध पत्र Language-TPP को प्रस्तुत करता है, जो एक एकीकृत ढांचा है जो निरंतर समय अंतराल को बाइट-टोकन में परिवर्तित करके टेम्पोरल पॉइंट प्रोसेसेज और लार्ज लैंग्वेज मॉडल्स के बीच के अंतर को पाटता है, जिससे वेब इवेंट अनुक्रमों की अत्याधुनिक मॉडलिंग सक्षम होती है जो टेम्पोरल डायनेमिक्स और समृद्ध टेक्स्टुअल पैटर्न दोनों को प्रभावी ढंग से कैप्चर करती है।

Quyu Kong, Yixuan Zhang, Yang Liu, Panrong Tong, Enqi Liu, Feng Zhou2026-03-19
💬 NLP

Comparing Uncertainty Measurement and Mitigation Methods for Large Language Models: A Systematic Review

यह शोध पत्र लार्ज लैंग्वेज मॉडल्स (LLMs) के लिए अनिश्चितता परिमाणीकरण (uncertainty quantification) और अंशांकन (calibration) विधियों का पहला समर्पित व्यवस्थित समीक्षा और कठोर बेंचमार्क प्रस्तुत करता है, जो मतिभ्रम (hallucination) को संबोधित करने और भविष्य के अनुसंधान दिशाओं को निर्देशित करने के लिए छह दृष्टिकोणों का अनुभवजन्य मूल्यांकन करता है।

Toghrul Abbasli, Kentaroh Toyoda, Yuan Wang, Leon Witt, Muhammad Asif Ali, Yukai Miao, Dan Li, Qingsong Wei2026-03-19
💬 NLP

Signal in the Noise: Polysemantic Interference Transfers and Predicts Cross-Model Influence

छोटे मॉडलों में अर्थहीन रूप से असंबंधित किंतु हस्तक्षेप करने वाले बहुरूपी (polysemantic) लक्षणों की पहचान करने और उन पर हस्तक्षेप करने के लिए स्पार्स ऑटोएनकोडर्स का लाभ उठाते हुए, यह अध्ययन प्रदर्शित करता है कि ऐसे हस्तक्षेप पैटर्न स्केल और आर्किटेक्चर के पार सामान्यीकृत होते हैं, जो बड़े ब्लैक-बॉक्स लैंग्वेज मॉडल्स में पूर्वानुमानित व्यवहार नियंत्रण को सक्षम बनाते हैं और आंतरिक निरूपणों के एक अभिसारी, उच्च-क्रम संगठन को प्रकट करते हैं।

Bofan Gong, Shiyang Lai, James Evans, Dawn Song2026-03-19
🔬 physics

A quantitative analysis of semantic information in deep representations of text and images

यह शोध पत्र सूचना असंतुलन (Information Imbalance) का उपयोग यह प्रदर्शित करने के लिए करता है कि गहरे मॉडलों में अर्थ संबंधी सूचना (semantic information) भाषाओं, माध्यमों (modalities) और आर्किटेक्चर के बीच अभिसरित होती है, जो यह प्रकट करता है कि पूर्वानुमान क्षमता विशिष्ट केंद्रीय या अंतिम परतों में सबसे मजबूत होती है और बड़े, स्वतंत्र रूप से प्रशिक्षित मॉडल क्रॉस-मोडल संरेखण में संयुक्त रूप से प्रशिक्षित मल्टीमॉडल मॉडलों से बेहतर प्रदर्शन कर सकते हैं।

Santiago Acevedo, Andrea Mascaretti, Riccardo Rende, Matéo Mahaut, Marco Baroni, Alessandro Laio2026-03-19
💬 NLP

ToolRegistry: A Protocol-Agnostic Tool Management Library for Function-Calling LLMs

यह शोध पत्र ToolRegistry को प्रस्तुत करता है, जो एक मॉड्यूलर, प्रोटोकॉल-अज्ञेय (protocol-agnostic) इकोसिस्टम है जो एक कोर रजिस्ट्री, सर्वर एडेप्टर और प्रोडक्शन-रेडी टूल्स के क्यूरेटेड हब के माध्यम से टूल प्रबंधन, निष्पादन और एकीकरण को एकीकृत करके LLM अनुप्रयोगों के लिए विकास ओवरहेड को काफी कम करता है और प्रदर्शन में सुधार करता है।

Peng Ding2026-03-19
💬 NLP

Incongruent Positivity: When Miscalibrated Positivity Undermines Online Supportive Conversations

यह शोध पत्र "इनकोग्रुएंट पॉजिटिविटी" (असंगत सकारात्मकता) की जांच करता है, जहाँ नेक इरादे वाले लेकिन गलत तरीके से अंशांकित सकारात्मक उत्तर ऑनलाइन सहायता को कमजोर कर देते हैं, जो यह प्रकट करता है कि लार्ज लैंग्वेज मॉडल्स उच्च-जोखिम वाले भावनात्मक संदर्भों में इस तरह के उपेक्षापूर्ण आशावाद के प्रति विशेष रूप से संवेदनशील होते हैं और अधिक संदर्भ-जागरूक, विश्वास-संरक्षण करने वाले सहायक संवाद प्रणालियों के विकास के मार्गदर्शन हेतु एक पहचान ढांचे का प्रस्ताव करता है।

Leen Almajed, Abeer ALdayel2026-03-19
💬 NLP

IA2: Alignment with ICL Activations Improves Supervised Fine-Tuning

यह शोध पत्र ICL एक्टिवेशन अलाइनमेंट (IA2) प्रस्तुत करता है, जो एक सेल्फ-डिस्टिलेशन तकनीक है जो सुपर्वाइज्ड फाइन-ट्यूनिंग (SFT) मॉडल्स को इन-कॉन्टेक्स्ट लर्निंग (ICL) के आंतरिक एक्टिवेशन पैटर्न के साथ अलाइन करती है ताकि कई बेंचमार्क में आउटपुट सटीकता और कैलिब्रेशन में महत्वपूर्ण सुधार किया जा सके।

Aayush Mishra, Daniel Khashabi, Anqi Liu2026-03-19