💬 NLP

PaTH Attention: Position Encoding via Accumulating Householder Transformations

यह शोध पत्र PaTH को प्रस्तुत करता है, जो संचित हाउसहोल्डर रूपांतरणों (accumulated Householder transformations) पर आधारित एक लचीला, डेटा-निर्भर स्थिति एन्कोडिंग (position encoding) तंत्र है, जो भाषा मॉडलिंग कार्यों में मानक रोटरी पोजीशन एन्कोडिंग (RoPE) से बेहतर प्रदर्शन करता है और साथ ही कुशल समानांतर प्रशिक्षण और प्रीट्रेन्ड RoPE मॉडल को परिवर्तित करने की क्षमता भी प्रदान करता है।

Songlin Yang, Yikang Shen, Kaiyue Wen, Shawn Tan, Mayank Mishra, Liliang Ren, Rameswar Panda, Yoon Kim2026-02-05
💬 NLP

Evaluating and Steering Modality Preferences in Multimodal Large Language Model

यह शोध पत्र बहुविध बड़े भाषा मॉडलों (MLLMs) में मोडैलिटी प्राथमिकताओं को व्यवस्थित रूप से मूल्यांकन करने के लिए MC² बेंचमार्क प्रस्तुत करता है, जो यह प्रकट करता है कि ये प्राथमिकताएं कार्य प्रदर्शन के साथ सह-संबंधित हैं और बिना किसी अतिरिक्त फाइन-ट्यूनिंग के, एक रिप्रेजेंटेशन इंजीनियरिंग-आधारित विधि का उपयोग करके वांछित दिशाओं की ओर प्रभावी ढंग से निर्देशित की जा सकती हैं।

Yu Zhang, Jinlong Ma, Yongshuai Hou, Xuefeng Bai, Kehai Chen, Yang Xiang, Jun Yu, Min Zhang2026-02-05
💬 NLP

DPO Unchained: Your Training Algorithm is Secretly Disentangled in Human Choice Theory

यह शोध पत्र डायरेक्ट प्रेफरेंस ऑप्टिमाइजेशन (DPO) और मानव चयन सिद्धांत के बीच के संबंध को मानदण्डिक मॉडलों (normative models) को पुनर्गठित करके सामान्यीकृत करता है ताकि एक व्यापक ढांचा तैयार किया जा सके जो गैर-उत्तल नुकसानों (non-convex losses) का समर्थन करता है, विविध विश्लेषणात्मक विकल्पों को समाहित करता है, और विभिन्न DPO विस्तारों को सुरक्षित करता है।

Wenxuan Zhou, Shujian Zhang, Brice Magdalou, John Lambert, Ehsan Amid, Richard Nock, Andrew Hard2026-02-05
💬 NLP

PromotionGo at SemEval-2025 Task 11: A Feature-Centric Framework for Cross-Lingual Multi-Emotion Detection in Short Texts

यह शोध पत्र लघु ग्रंथों में क्रॉस-लिंगुअल बहु-भावना पहचान के लिए एक स्केलेबल, फीचर-केंद्रित ढांचे को प्रस्तुत करता है जो 28 भाषाओं में दस्तावेज़ निरूपण और शिक्षण एल्गोरिदम को गतिशील रूप से अनुकूलित करता है, यह प्रदर्शित करते हुए कि TF-IDF कम-संसाधन सेटिंग्स में उत्कृष्ट है जबकि कॉन्टेक्स्टुअल एम्बेडिंग्स और PCA-उन्नत न्यूरल मॉडल विविध भाषाई संदर्भों के लिए अनुकूलित प्रदर्शन और दक्षता प्रदान करते हैं।

Ziyi Huang, Xia Cui2026-02-05
💬 NLP

Addressing Data Imbalance in Transformer-Based Multi-Label Emotion Detection with Weighted Loss

यह शोध पत्र BRIGHTER डेटासेट पर मल्टी-लेबल इमोशन डिटेक्शन के लिए ट्रांसफॉर्मर-आधारित मॉडलों में वेटेड लॉस फंक्शन्स के उपयोग की जांच करता है, जिसमें यह पाया गया है कि हालांकि यह दृष्टिकोण उच्च-आवृत्ति वाली श्रेणियों (high-frequency classes) के प्रदर्शन को प्रभावी ढंग से बढ़ाता है, लेकिन यह अल्पसंख्यक इमोशन श्रेणियों (minority emotion classes) के लिए सीमित सुधार प्रदान करता है।

Xia Cui2026-02-05
💬 NLP

The Invisible Leash: Why RLVR May or May Not Escape Its Origin

यह शोध पत्र अनुभवजन्य रूप से यह प्रदर्शित करता है कि जबकि सत्यापन योग्य पुरस्कारों के साथ सुदृढीकरण शिक्षण (RLVR) एलएलएम (LLM) की सटीकता में महत्वपूर्ण सुधार करता है, यह अंततः तर्क की सीमाओं को विस्तार देने में विफल रहता है क्योंकि इसका समर्थन-सीमित अनुकूलन मॉडल के समाधान स्थान को संकुचित कर देता है, जिससे अक्सर यह उन सही उत्तरों की अनदेखी कर देता है जो पहले मूल मॉडल के लिए सुलभ थे।

Fang Wu, Weihao Xuan, Ximing Lu, Mingjie Liu, Yi Dong, Zaid Harchaoui, Yejin Choi2026-02-05
📊 statistics

Improving Detection of Watermarked Language Models

यह शोध पत्र हाइब्रिड डिटेक्शन स्कीमों का प्रस्ताव और मूल्यांकन करता है जो वॉटरमार्क-आधारित और गैर-वॉटरमार्क-आधारित डिटेक्टरों को संयोजित करते हैं ताकि वॉटरमार्क किए गए लैंग्वेज मॉडल जनरेशन की पहचान में सुधार किया जा सके, विशेष रूप से उन परिदृश्यों में जहाँ सीमित एंट्रॉपी स्टैंडअलोन वॉटरमार्क डिटेक्शन में बाधा डालती है।

Dara Bahri, John Wieting2026-02-05
💬 NLP

When Avatars Have Personality: Effects on Engagement and Communication in Immersive Medical Training

यह शोध पत्र एक मॉड्यूलर फ्रेमवर्क प्रस्तुत करता है जो चिकित्सकीय रूप से सुसंगत और व्यक्तित्व-संचालित वर्चुअल रोगियों को बनाने के लिए वर्चुअल रियलिटी में लार्ज लैंग्वेज मॉडल्स को एकीकृत करता है, और लाइसेंस प्राप्त चिकित्सकों के साथ एक अध्ययन के माध्यम से यह प्रदर्शित करता है कि ऐसे मनोवैज्ञानिक रूप से विश्वसनीय अवतार संचार कौशल के लिए इमर्सिव मेडिकल ट्रेनिंग को महत्वपूर्ण रूप से बढ़ाते हैं।

Julia S. Dollis, Iago A. Brito, Fernanda B. Färber, Pedro S. F. B. Ribeiro, Gustavo H. W. Barbosa, Andressa A. Bastos, R (…)2026-02-05
💬 NLP

MapCoder-Lite: Distilling Multi-Agent Coding into a Single Small LLM

MapCoder-Lite एक ऐसा फ्रेमवर्क है जो ट्राजेक्टरी डिस्टिलेशन (trajectory distillation), सुपरवाइजर-गाइडेड करेक्शन (supervisor-guided correction) और एजेंट-वाइज लोरा फाइन-ट्यूनिंग (agent-wise LoRA fine-tuning) की एक नवीन तीन-स्तंभ पद्धति के माध्यम से जटिल मल्टी-एजेंट कोडिंग क्षमताओं को एक एकल 7B लैंग्वेज मॉडल में संकुचित करता है, जिससे बड़े मॉडलों की तुलना में कम्प्यूटेशनल लागतों को काफी कम करते हुए कोडिंग बेंचमार्क पर प्रतिस्पर्धी प्रदर्शन प्राप्त होता है।

Woongkyu Lee, Junhee Cho, Jungwook Choi2026-02-05
💬 NLP

Anticipatory Evaluation of Language Models

यह शोध पत्र PRECOG को कार्य विवरणों और प्रदर्शन मेट्रिक्स के एक संग्रह के रूप में प्रस्तुत करता है, यह प्रदर्शित करने के लिए कि बड़े भाषा मॉडल (large language models) केवल कार्य विवरणों और प्रयोगात्मक विन्यासों के आधार पर मूल्यांकन परिणामों का पूर्वानुमान लगा सकते हैं, जिससे एआई अनुसंधान में वर्तमान मूल्यांकन बाधा को दूर करने का एक मार्ग प्रशस्त होता है।

Jungsoo Park, Ethan Mendes, Gabriel Stanovsky, Alan Ritter2026-02-05