💬 NLP

WAVE++: Capturing Within-Task Variance for Continual Relation Extraction with Adaptive Prompting

WAVE++ निरंतर संबंध निष्कर्षण (Continual Relation Extraction) के लिए एक नवीन प्रॉम्प्ट-आधारित दृष्टिकोण है जो कार्य-विशिष्ट प्रॉम्प्ट पूल्स (task-specific prompt pools), लेबल विवरणों और एक जनरेटिव मॉडल का उपयोग करके ज्ञान को समेकित करता है, जिससे बिना किसी स्पष्ट डेटा भंडारण की आवश्यकता के कैटास्ट्रोफिक फॉरगेटिंग (catastrophic forgetting) को कम किया जाता है और कार्य विविधताओं को संभाला जाता है।

Bao-Ngoc Dao, Minh Le, Quang Nguyen, Luyen Ngo Dinh, Nam Le, Linh Ngo Van2026-02-12
💬 NLP

Attributing Response to Context: A Jensen-Shannon Divergence Driven Mechanistic Study of Context Attribution in Retrieval-Augmented Generation

यह शोध पत्र ARC-JSD पेश करता है, जो एक गणनात्मक रूप से कुशल विधि है जो फाइन-ट्यूनिंग की आवश्यकता के बिना RAG सिस्टम में विशिष्ट संदर्भ खंडों (context segments) के प्रति जनरेट की गई प्रतिक्रियाओं को सटीक रूप से एट्रिब्यूट करने के लिए जेन्सन-शैनन डायवर्जेंस (Jensen-Shannon Divergence) का उपयोग करता है, और साथ ही इस एट्रिब्यूशन के लिए जिम्मेदार विशिष्ट अटेंशन हेड्स (attention heads) और MLP परतों में यांत्रिक अंतर्दृष्टि भी प्रदान करता है।

Ruizhe Li, Chen Chen, Yuchen Hu, Yanjun Gao, Xi Wang, Emine Yilmaz2026-02-12
💬 NLP

Is Your LLM Really Mastering the Concept? A Multi-Agent Benchmark

यह शोध पत्र CK-Arena प्रस्तुत करता है, जो "अंडरकवर" सोशल डिडक्शन गेम पर आधारित एक डायनेमिक मल्टी-एजेंट बेंचमार्क है, जिसे यह मूल्यांकन करने के लिए डिज़ाइन किया गया है कि क्या लार्ज लैंग्वेज मॉडल्स वास्तव में वैचारिक संरचनाओं में महारत हासिल करते हैं या वे केवल सतही स्तर के पैटर्न याद रखने (सरफेस-लेवल पैटर्न मेमोराइजेशन) पर निर्भर करते हैं।

Shuhang Xu, Weijian Deng, Yixuan Zhou, Fangwei Zhong2026-02-12
💬 NLP

Unveiling the "Fairness Seesaw": Discovering and Mitigating Gender and Race Bias in Vision-Language Models

यह शोध पत्र आंतरिक हिडन स्टेट्स (hidden states) और प्रोबेबिलिटी डिस्ट्रीब्यूशंस का विश्लेषण करके विजन-लैंग्वेज मॉडल्स में जेंडर और रेस बायस की व्यवस्थित रूप से जांच करता है, यह पाते हुए कि बायस अक्सर कॉन्फिडेंस स्कोर और विशिष्ट रेसिडुअल स्ट्रीम्स में बना रहता है, और हिडन स्टेट डायनेमिक्स को रीकैलिब्रेट करके इन बायसेस को कम करने के लिए RES-FAIR नामक एक पोस्ट-हॉक फ्रेमवर्क प्रस्तावित करता है।

Jian Lan, Udo Schlegel, Tanveer Hannan, Gengyuan Zhang, Haokun Chen, Thomas Seidl2026-02-12
💬 NLP

Cross-Attention Speculative Decoding

यह शोध पत्र बजट ईगल (बीगल) को प्रस्तुत करता है, जो एक सरलीकृत क्रॉस-अटेंशन-आधारित स्पेक्युलेटिव डिकोडिंग आर्किटेक्चर है जो एक नवीन टू-स्टेज ब्लॉक-अटेंशन ट्रेनिंग पद्धति के माध्यम से बेहतर प्रशिक्षण दक्षता और वास्तुशिल्प सरलता प्रदान करते हुए अत्याधुनिक सेल्फ-अटेंशन मॉडलों के तुलनीय प्रदर्शन प्राप्त करता है।

Wei Zhong, Manasa Bharadwaj, Yixiao Wang, Yipeng Ji, Chul Lee2026-02-12
💬 NLP

Towards Efficient Speech-Text Jointly Decoding within One Speech Language Model

यह शोध पत्र व्यवस्थित रूप से स्पीच-टेक्स्ट जॉइंट डिकोडिंग प्रतिमानों (paradigms) की तुलना करता है और एक नवीन "अर्ली-स्टॉप इंटरलीव्ड" (ESI) पैटर्न प्रस्तावित करता है जो स्पीच लैंग्वेज मॉडल्स में प्रदर्शन को बनाए रखते हुए या उसमें सुधार करते हुए इन्फरेंस गति को महत्वपूर्ण रूप से तेज करता है।

Haibin Wu, Yuxuan Hu, Ruchao Fan, Xiaofei Wang, Kenichi Kumatani, Bo Ren, Jianwei Yu, Heng Lu, Lijuan Wang, Yao Qian, Ji (…)2026-02-12
💬 NLP

Scaling Towards the Information Boundary of Instruction Sets: The Infinity Instruct Subject Technical Report

वर्तमान निर्देश डेटासेट की कवरेज और जटिलता संबंधी सीमाओं को संबोधित करने के लिए, यह शोध पत्र निरंतर डेटा विकास के लिए एक व्यवस्थित, पुनरावृत्ति क्लोज्ड-लूप फ्रेमवर्क का प्रस्ताव करता है और "इन्फिनिटी इंस्ट्रक्ट सब्जेक्ट" (Infinity Instruct Subject) पेश करता है, जो 1.5 मिलियन निर्देशों का एक उच्च-गुणवत्ता वाला डेटासेट है जो बड़े पैमाने के मॉडलों की निर्देश-अनुसरण करने की क्षमताओं को महत्वपूर्ण रूप से बढ़ाता है।

Li Du, Hanyu Zhao, Yiming Ju, Tengfei Pan2026-02-12
💬 NLP

AFD-SLU: Adaptive Feature Distillation for Spoken Language Understanding

यह शोध पत्र AFD-SLU का प्रस्ताव करता है, जो एक एडेप्टिव फीचर डिस्टिलेशन फ्रेमवर्क है जो एक डायनेमिक एडेप्टर और प्रदर्शन-आधारित डिस्टिलेशन गुणांक का उपयोग करता है ताकि बेहतर स्पोकन लैंग्वेज अंडरस्टैंडिंग के लिए एक बड़े टीचर मॉडल से हल्केवेट स्टूडेंट मॉडल में सिमेंटिक ज्ञान को कुशलतापूर्वक स्थानांतरित किया जा सके।

Yan Xie, Yibo Cui, Liang Xie, Erwei Yin2026-02-12
💬 NLP

Bridging Fairness and Explainability: Can Input-Based Explanations Promote Fairness in Hate Speech Detection?

यह शोध पत्र घृणास्पद भाषण (हेट स्पीच) का पता लगाने में इनपुट-आधारित स्पष्टीकरणों और निष्पक्षता के बीच संबंध पर एक व्यवस्थित मात्रात्मक अध्ययन प्रस्तुत करता है, जिसमें यह पाया गया है कि हालांकि स्पष्टीकरण पक्षपाती भविष्यवाणियों का पता लगाने और प्रशिक्षण के दौरान पूर्वाग्रह शमन में सहायता कर सकते हैं, वे सबसे निष्पक्ष मॉडल चुनने के लिए अविश्वसनीय हैं।

Yifan Wang, Mayank Jobanputra, Ji-Ung Lee, Soyoung Oh, Isabel Valera, Vera Demberg2026-02-12
💬 NLP

Agentic Jigsaw Interaction Learning for Enhancing Visual Perception and Reasoning in Vision-Language Models

AGILE एक नवीन ढांचा है जो जिग्सॉ पहेलियों को एक संवादात्मक, कोड-संचालित अन्वेषण प्रक्रिया के रूप में तैयार करके और सूक्ष्म दृश्य प्रतिक्रिया प्रदान करके विजन-लैंग्वेज मॉडल्स की संवेदी और तर्क संबंधी क्षमताओं को बढ़ाता है।

Yu Zeng, Wenxuan Huang, Shiting Huang, Xikun Bao, Yukun Qi, Yiming Zhao, Qiuchen Wang, Lin Chen, Zehui Chen, Huaian Chen (…)2026-02-12