💬 NLP

Are Language Models Sensitive to Morally Irrelevant Distractors?

यह शोध पत्र इस बात की जांच करता है कि क्या बड़े भाषा मॉडल (लार्ज लैंग्वेज मॉडल्स) मानवीय नैतिक अस्थिरता प्रदर्शित करते हैं, यह दर्शाते हुए कि नैतिक रूप से अप्रासंगिक परिस्थितिजन्य व्याकुलता (डिस्ट्रैक्टर्स) को डालने से उनके नैतिक निर्णयों में 30% से अधिक का बदलाव आ सकता है, यहाँ तक कि कम अस्पष्टता वाले परिदृश्यों में भी।

Andrew Shaw, Christina Hahn, Catherine Rasgaitis, Yash Mishra, Alisa Liu, Natasha Jaques, Yulia Tsvetkov, Amy X. Zhang2026-02-11
💬 NLP

Breaking the Pre-Sampling Barrier: Activation-Informed Difficulty-Aware Self-Consistency

यह शोध पत्र एक्टिवेशन-इन्फॉर्म्ड डिफिकल्टी-अवेयर सेल्फ-कंसिस्टेंसी (ACTSC) का प्रस्ताव करता है, जो एक विधि है जो बिना किसी अतिरिक्त मॉडल कॉल या प्री-सैंपलिंग के, आंतरिक न्यूरॉन एक्टिवेशन पर आधारित एक लाइटवेट प्रोब का उपयोग करके रीजनिंग सैंपल्स की संख्या को गतिशील रूप से समायोजित करके सेल्फ-कंसिस्टेंसी की इन्फरेंस लागत को कम करती है।

Taewoong Yoon, Geunyeong Jeong, Geon Park, Sihyeong Yeom, Harksoo Kim2026-02-11
💬 NLP

Where-to-Unmask: Ground-Truth-Guided Unmasking Order Learning for Masked Diffusion Language Models

यह शोध पत्र मास्क्ड डिफ्यूजन लैंग्वेज मॉडल्स के लिए एक सुपरवाइज्ड अनमास्किंग प्लानर प्रस्तावित करता है जो ग्राउंड-ट्रुथ टोकन कॉन्फिडेंस मार्जिन से प्राप्त ओरैकल अनमास्किंग ऑर्डर की नकल करना सीखकर जनरेशन की गुणवत्ता और तार्किक तर्क (लॉजिकल रीजनिंग) में सुधार करता है।

Hikaru Asano, Tadashi Kozuno, Kuniaki Saito, Yukino Baba2026-02-11
💬 NLP

The CLEF-2026 CheckThat! Lab: Advancing Multilingual Fact-Checking

CLEF-2026 CheckThat! Lab तीन मुख्य कार्यों के माध्यम से बहुभाषी दुष्प्रचार के विरुद्ध मुकाबला करने को आगे बढ़ाने पर केंद्रित है: वैज्ञानिक स्रोतों को पुनः प्राप्त करना, संख्यात्मक और सामयिक दावों की तथ्य-जांच करना, और व्यापक तथ्य-जांच लेख तैयार करना।

Julia Maria Struß, Sebastian Schellhammer, Stefan Dietze, Venktesh V, Vinay Setty, Tanmoy Chakraborty, Preslav Nakov, Av (…)2026-02-11
💬 NLP

Comprehensive Comparison of RAG Methods Across Multi-Domain Conversational QA

यह शोध पत्र आठ बहु-डोमेन डेटासेटों पर एक व्यापक अनुभवजन्य अध्ययन प्रस्तुत करता है, जो यह प्रदर्शित करता है कि प्रभावी संवादात्मक RAG (Conversational RAG), विधि की जटिलता के बजाय रिट्रीवल रणनीतियों और डेटासेट की विशेषताओं के बीच संरेखण पर अधिक निर्भर करता है, जिसमें रीरैंकिंग (reranking) और HyDE जैसी सरल तकनीकें अक्सर अधिक उन्नत दृष्टिकोणों से बेहतर प्रदर्शन करती हैं।

Klejda Alushi, Jan Strich, Chris Biemann, Martin Semmann2026-02-11
💬 NLP

LEMUR: A Corpus for Robust Fine-Tuning of Multilingual Law Embedding Models for Retrieval

यह शोध पत्र LEMUR को प्रस्तुत करता है, जो यूरोपीय संघ के पर्यावरणीय कानून का एक बड़े पैमाने का बहुभाषी संग्रह है, और यह प्रदर्शित करता है कि इस उच्च-सटीकता वाले डेटा पर बहुभाषी एम्बेडिंग मॉडल को फाइन-ट्यून करने से कानूनी सूचना पुनर्प्राप्ति की सटीकता में महत्वपूर्ण सुधार होता है, विशेष रूप से कम-संसाधन और क्रॉस-लिंगुअल परिदृश्यों के लिए।

Narges Baba Ahmadi, Jan Strich, Martin Semmann, Chris Biemann2026-02-11
💬 NLP

Improving Interpretability of Lexical Semantic Change with Neurobiological Features

यह शोध पत्र संदर्भ-आधारित शब्द एम्बेडिंग (contextualized word embeddings) को एक न्यूरोबायोलॉजिकल फीचर स्पेस में मैप करके लेक्सिकल सिमेंटिक चेंज (LSC) की व्याख्यात्मकता (interpretability) में सुधार करने के लिए एक विधि प्रस्तावित करता है, जो अर्थ परिवर्तन के अनुमान में बेहतर प्रदर्शन और अर्थ परिवर्तनों के विशिष्ट प्रकारों की व्यवस्थित खोज, दोनों की अनुमति देता है।

Kohei Oda, Hiroya Takamura, Kiyoaki Shirai, Natthawut Kertkeidkachorn2026-02-11
💬 NLP

Why Linear Interpretability Works: Invariant Subspaces as a Result of Architectural Constraints

यह शोध पत्र यह प्रस्तावित करता है कि रैखिक व्याख्यात्मकता (linear interpretability) विधियाँ इसलिए सफल होती हैं क्योंकि ट्रांसफार्मर आर्किटेक्चर अपने रैखिक संचार इंटरफेस के माध्यम से अर्थ संबंधी जानकारी को संदर्भ-अपरिवर्तनीय रैखिक उप-स्थानों (context-invariant linear subspaces) में संकुचित करने के लिए बाध्य करते हैं, एक ऐसी घटना जिसे वे "इनवेरिएंट सबस्पेस नेसेसिटी" (Invariant Subspace Necessity) प्रमेय के रूप में औपचारिक रूप देते हैं।

Andres Saurez, Yousung Lee, Dongsoo Har2026-02-11
💬 NLP

Circuit Fingerprints: How Answer Tokens Encode Their Geometrical Path

यह शोध पत्र "सर्किट फिंगरप्रिंट" (Circuit Fingerprint) परिकल्पना का प्रस्ताव करता है, जो यह प्रतिपादित करता है कि उत्तर टोकन (answer tokens) ज्यामितीय रूप से उन सर्किट्स की दिशाओं को कूटबद्ध (encode) करते हैं जो उन्हें उत्पन्न करते हैं, जिससे ग्रेडिएंट-आधारित या कारण संबंधी हस्तक्षेप (causal intervention) विधियों के बजाय ज्यामितीय संरेखण (geometric alignment) के माध्यम से सर्किट की खोज और सक्रियता स्टीयरिंग (activation steering) संभव हो पाती है।

Andres Saurez, Neha Sengar, Dongsoo Har2026-02-11
💬 NLP

Where Are We At with Automatic Speech Recognition for the Bambara Language?

यह शोध पत्र माली के संवैधानिक पाठ के एक नियंत्रित डेटासेट के विरुद्ध 37 मॉडलों का मूल्यांकन करके बम्बारा स्वचालित भाषण पहचान (ASR) के लिए पहले मानकीकृत बेंचमार्क को प्रस्तुत करता है, जिससे यह पता चलता है कि शीर्ष प्रदर्शन करने वाली प्रणालियाँ भी तैनाती के मानकों से काफी पीछे रह जाती हैं।

Seydou Diallo, Yacouba Diarra, Mamadou K. Keita, Panga Azazia Kamaté, Adam Bouno Kampo, Aboubacar Ouattara2026-02-11