💬 NLP

MultiLexNorm++: A Unified Benchmark and a Generative Model for Lexical Normalization for Asian Languages

यह शोध पत्र मौजूदा इंडो-यूरोपीय-केंद्रित डेटासेट की सीमाओं को दूर करने के लिए चार लिपियों में पाँच एशियाई भाषाओं को कवर करने वाला एक एकीकृत बेंचमार्क, MultiLexNorm++ पेश करता है, और एक नया लार्ज लैंग्वेज मॉडल-आधारित आर्किटेक्चर प्रस्तावित करता है जो इन विविध भाषाओं के लिए लेक्सिकल नॉर्मलाइजेशन (lexical normalization) हेतु अधिक सुदृढ़ प्रदर्शन प्रदर्शित करता है।

Weerayut Buaphet, Thanh-Nhi Nguyen, Risa Kondo, Tomoyuki Kajiwara, Yumin Kim, Jimin Lee, Hwanhee Lee, Holy Lovenia, Peer (…)2026-01-26
💬 NLP

Typologically Informed Parameter Aggregation

यह शोध पत्र टाइपोलॉजिकल इन्फॉर्म्ड पैरामीटर एग्रीगेशन (TIPA) को प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त विधि है जो टाइपोलॉजिकल समानता के आधार पर मौजूदा एडेप्टर को एकत्रित करके प्रॉक्सी लैंग्वेज एडेप्टर का निर्माण करती है, जिससे भाषा-विशिष्ट फाइन-ट्यूनिंग की लागत के बिना कम-संसाधन और अनदेखी भाषाओं के लिए प्रभावी ज़ीरो-शॉट क्रॉस-लिंगुअल ट्रांसफर सक्षम होता है।

Stef Accou, Wessel Poelman2026-01-26
💬 NLP

Sycophancy Hides Linearly in the Attention Heads

यह शोध पत्र यह प्रदर्शित करता है कि भाषा मॉडलों में चाटुकारिता (सिकोफैन्टिक) व्यवहार मध्य-परत के अटेंशन हेड्स के एक विरल उपसमुच्चय के भीतर सबसे अधिक रैखिक रूप से पृथकरणीय और प्रभावी रूप से शमन योग्य है, जो विशेष रूप से उपयोगकर्ता की संदेह की अभिव्यक्तियों पर ध्यान केंद्रित करते हैं और सामान्य तथ्यात्मक सटीकता से भिन्न तंत्रों के माध्यम से कार्य करते हैं।

Rifo Genadi, Munachiso Nwadike, Nurdaulet Mukhituly, Hilal Alquabeh, Tatsuya Hiraoka, Kentaro Inui2026-01-26
💬 NLP

EMemBench: Interactive Benchmarking of Episodic Memory for VLM Agents

यह शोध पत्र EMemBench प्रस्तुत करता है, जो VLM एजेंटों में एपिसोडिक मेमोरी (episodic memory) का मूल्यांकन करने के लिए एजेंट प्रक्षेपवक्र (agent trajectories) से सत्यापन योग्य, संवादात्मक प्रश्न उत्पन्न करने वाला एक प्रोग्रामेटिक बेंचमार्क है, जो इंडक्शन (induction) और स्थानिक तर्क (spatial reasoning) में निरंतर चुनौतियों को प्रकट करता है और साथ ही यह प्रदर्शित करता है कि टेक्स्ट-आधारित एजेंटों की तुलना में विजुअली ग्राउंडेड (visually grounded) एजेंटों के लिए मेमोरी मैकेनिज्म्स असंगत सुधार प्रदान करते हैं।

Xinze Li, Ziyue Zhu, Siyuan Liu, Yubo Ma, Yuhang Zang, Yixin Cao, Aixin Sun2026-01-26
💬 NLP

Mitigating Bias in Automated Grading Systems for ESL Learners: A Contrastive Learning Approach

यह अध्ययन मेल किए गए निबंध युग्मों (matched essay pairs) के साथ एक कंट्रास्टिव लर्निंग दृष्टिकोण का उपयोग करके ESL शिक्षार्थियों के विरुद्ध स्वचालित निबंध स्कोरिंग में एल्गोरिद्मिक पूर्वाग्रह को संबोधित करता है, जिसने समग्र ग्रेडिंग सटीकता बनाए रखते हुए उच्च-दक्षता स्कोरिंग असमानताओं को 39.9% तक सफलतापूर्वक कम कर दिया।

Kevin Fan, Eric Yun2026-01-26
💬 NLP

SoS: Analysis of Surface over Semantics in Multilingual Text-To-Image Generation

यह शोध पत्र बहुभाषी टेक्स्ट-टू-इमेज मॉडलों में "सरफेस-ओवर-सिमेंटिक्स" (SoS) घटना का पहला व्यापक विश्लेषण प्रस्तुत करता है, जो यह प्रकट करता है कि अधिकांश मॉडल अर्थ संबंधी अर्थ के बजाय सतही भाषाई संकेतों को प्राथमिकता देते हैं, जिससे विभिन्न भाषाओं और संस्कृतियों में सांस्कृतिक रूप से रूढ़िवादी चित्रण उत्पन्न होते हैं।

Carolin Holtermann, Florian Schneider, Anne Lauscher2026-01-26
💬 NLP

Reasoning Promotes Robustness in Theory of Mind Tasks

यह शोधपत्र यह प्रदर्शित करता है कि तर्क-उन्मुख (reasoning-oriented) लार्ज लैंग्वेज मॉडल्स, थ्योरी ऑफ माइंड कार्यों पर बेहतर प्रदर्शन मुख्य रूप से प्रॉम्प्ट विविधताओं और व्यवधानों के प्रति बढ़ी हुई सुदृढ़ता (robustness) के माध्यम से प्राप्त करते हैं, न कि मौलिक रूप से नए सामाजिक-संज्ञानात्मक तर्क के रूपों को विकसित करके।

Ian B. de Haan, Peter van der Putten, Max van Duijn2026-01-26
💬 NLP

Paramanu: Compact and Competitive Monolingual Language Models for Low-Resource Morphologically Rich Indian Languages

यह शोधपत्र परमाणु (Paramanu) का परिचय देता है, जो पांच प्रमुख भारतीय भाषाओं के लिए ओपन-सोर्स डेटा से शून्य से प्रशिक्षित कॉम्पैक्ट और लागत प्रभावी मोनोलिंगुअल लैंग्वेज मॉडल्स का एक परिवार है, जो अपने छोटे आकार और सिंगल-जीपीयू ट्रेनिंग बजट के बावजूद बड़े मल्टीलिंगुअल मॉडल्स को पछाड़ने के लिए विशेष टोकेनाइज़र और प्रशिक्षण तकनीकों का उपयोग करता है।

Mitodru Niyogi, Eric Gaussier, Arnab Bhattacharya2026-01-23
💬 NLP

Vision-Language Models Align with Human Neural Representations in Concept Processing

यह अध्ययन प्रदर्शित करता है कि विजन-लैंग्वेज मॉडल आम तौर पर मानव तंत्रिका संबंधी अवधारणाओं (न्यूरल रिप्रेजेंटेशन) के साथ केवल भाषा-आधारित मॉडलों की तुलना में बेहतर संरेखण रखते हैं, हालांकि इस संरेखण की सीमा विशिष्ट आर्किटेक्चर और इस बात पर निर्भर करती है कि यह वास्तविक अवधारणा शिक्षण से उत्पन्न होता है या अनुमान-समय संदर्भ (इन्फ्रेंस-टाइम कॉन्टेक्स्ट) के प्रति संवेदनशीलता से।

Anna Bavaresco, Marianne de Heer Kloots, Sandro Pezzelle, Raquel Fernández2026-01-23