💬 NLP

DialectGen: Benchmarking and Improving Dialect Robustness in Multimodal Generation

यह शोध पत्र DialectGen प्रस्तुत करता है, जो एक बड़े पैमाने का बेंचमार्क है जो बोली-आधारित इनपुट को संसाधित करते समय मल्टीमॉडल जनरेटिव मॉडल्स में महत्वपूर्ण प्रदर्शन गिरावट को प्रकट करता है, और एक नवीन एनकोडर-आधारित शमन रणनीति प्रस्तावित करता है जो मानक प्रदर्शन से समझौता किए बिना मानक अमेरिकी अंग्रेजी के स्तरों तक बोली संबंधी सुदृढ़ता को प्रभावी ढंग से पुनर्स्थापित करती है।

Yu Zhou, Sohyun An, Haikang Deng, Da Yin, Clark Peng, Cho-Jui Hsieh, Kai-Wei Chang, Nanyun Peng2026-04-08
💬 NLP

CoGate-LSTM: Prototype-Guided Feature-Space Gating for Mitigating Gradient Dilution in Imbalanced Toxic Comment Classification

यह शोध पत्र CoGate-LSTM प्रस्तुत करता है, जो एक पैरामीटर-कुशल आवर्ती (recurrent) आर्किटेक्चर है जो एक नवीन कोसाइन-समानता विशेषता गेटिंग तंत्र का उपयोग करता है ताकि टोकन एम्बेडिंग्स को सीखे गए विषाक्तता प्रोटोटाइप (toxicity prototypes) की ओर अनुकूल रूप से पुन: स्केल किया जा सके, जिससे असंतुलित डेटासेट पर दुर्लभ विषाक्त वर्गों का पता लगाने में कम कम्प्यूटेशनल लागत बनाए रखते हुए फाइन-ट्यून किए गए BERT की तुलना में काफी बेहतर प्रदर्शन होता है।

Noor Islam S. Mohammad2026-04-08
💬 NLP

Fairness Evaluation and Inference Level Mitigation in LLMs

यह शोधपत्र एक गतिशील, प्रतिवर्ती, इन्फरेंस-टाइम फ्रेमवर्क प्रस्तावित करता है जो संदर्भ-जागरूक न्यूरॉन सक्रियणों को अनुकूल रूप से मास्क करके लार्ज लैंग्वेज मॉडल्स में निष्पक्षता संबंधी मुद्दों और व्यवहार संबंधी विसंगतियों को कम करता है, जो स्थिर प्रूनिंग या महंगी रिट्रेनिंग विधियों के एक लचीले और मेमोरी-कुशल विकल्प के रूप में कार्य करता है।

Afrozah Nadeem, Mark Dras, Usman Naseem2026-04-08
💬 NLP

Thinking with Video: Video Generation as a Promising Multimodal Reasoning Paradigm

यह शोध पत्र "वीडियो के साथ सोचना" (Thinking with Video) को एक नवीन मल्टीमॉडल रीजनिंग प्रतिमान के रूप में प्रस्तावित करता है जो टेक्स्ट और इमेज-आधारित दृष्टिकोणों की सीमाओं को दूर करने के लिए सोरा-2 (Sora-2) जैसे वीडियो जनरेशन मॉडल्स को एक एकीकृत माध्यम के रूप में उपयोग करता है, और वीडियोथिंकबेंच (VideoThinkBench) के माध्यम से यह प्रदर्शित करता है कि ऐसे मॉडल्स विजन-केंद्रित और टेक्स्ट-केंद्रित रीजनिंग कार्यों पर अत्याधुनिक प्रदर्शन प्राप्त करते हैं।

Jingqi Tong, Yurong Mou, Hangcheng Li, Mingzhe Li, Yongzhuo Yang, Ming Zhang, Qiguang Chen, Tianyi Liang, Xiaomeng Hu, Y (…)2026-04-08
💬 NLP

PIAST: Rapid Prompting with In-context Augmentation for Scarce Training data

PIAST एक तीव्र, स्वचालित प्रॉम्प्टिंग विधि है जो मानव निर्देशों को मोंटे कार्लो शापली अनुमान (Monte Carlo Shapley estimation) और आक्रामक सबसैंपलिंग के माध्यम से अनुकूलित किए गए कुछ-शॉट उदाहरण सेट के साथ संवर्धित करती है, जिससे सीमित प्रशिक्षण डेटा और कंप्यूट बजट वाले विभिन्न कार्यों पर अत्याधुनिक प्रदर्शन प्राप्त होता है।

Pawel Batorski, Paul Swoboda2026-04-08
💬 NLP

Automatic Replication of LLM Mistakes in Medical Conversations

यह शोध पत्र MedMistake को प्रस्तुत करता है, जो एक स्वचालित पाइपलाइन है जो सिम्युलेटेड मेडिकल बातचीत से LLM त्रुटियों को 3,390 सिंगल-शॉट QA पेयर्स के बेंचमार्क डेटासेट में निकालती और परिवर्तित करती है, जिसे चिकित्सा विशेषज्ञों द्वारा सत्यापित किया गया था और विशिष्ट चिकित्सा तर्क संबंधी गलतियों से बचने में 12 फ्रंटियर मॉडलों के प्रदर्शन का मूल्यांकन करने के लिए उपयोग किया गया था।

Oleksii Proniakin, Diego Fajardo, Ruslan Nazarenko, Razvan Marinescu2026-04-08
💬 NLP

Frame of Reference: Addressing the Challenges of Common Ground Representation in Situational Dialogs

यह शोध पत्र स्थित संवादों (situated dialogs) में सामान्य आधार (common ground) के लिए "संबंधात्मक संदर्भों" (relational references) को स्थापित करने और उनका लाभ उठाने की बड़े भाषा मॉडलों (large language models) की क्षमता का मूल्यांकन करता है, जो साझा स्थानिक और लौकिक जानकारी को दर्शाने में उनके प्रदर्शन को सुधारने के लिए सिंथेटिक डेटा पर सुदृढीकरण शिक्षण (reinforcement learning) विधियों का प्रस्ताव करता है।

Biswesh Mohapatra, Théo Charlot, Giovanni Duca, Mayank Palan, Laurent Romary, Justine Cassell2026-04-08
💬 NLP

Forgetting as a Feature: Cognitive Alignment of Large Language Models

यह शोध पत्र लार्ज लैंग्वेज मॉडल्स (Large Language Models) में देखी जाने वाली व्यवस्थित विस्मृति (systematic forgetting) को मानव स्मृति क्षय (human memory decay) के समान एक कार्यात्मक संज्ञानात्मक तंत्र के रूप में पुनर्गठित करता है, इस संरेखण को मान्य करने के लिए एक बेंचमार्क सुइट पेश करता है, और एक "प्रायिकता आधारित मेमोरी प्रॉम्प्टिंग" (probabilistic memory prompting) रणनीति प्रस्तावित करता है जो दीर्घकालिक तर्क प्रदर्शन को बढ़ाने के लिए विस्मृति का लाभ उठाती है।

Alexandros Christoforos2026-04-08
💬 NLP

Legal Experts Disagree With Rationale Extraction Techniques for Explaining ECtHR Case Outcome Classification

यह शोध पत्र एक नया ECtHR डेटासेट और कानूनी परिणाम पूर्वानुमान के लिए तर्क निष्कर्षण (rationale extraction) तकनीकों का मूल्यांकन करने हेतु एक तुलनात्मक ढांचा प्रस्तुत करता है, जो यह प्रकट करता है कि जबकि वर्तमान विधियाँ उच्च निष्ठा (faithfulness) मेट्रिक्स प्राप्त करती हैं, कानूनी विशेषज्ञ निकाले गए तर्कों को अदालती निर्णयों के लिए वैध स्पष्टीकरण के रूप में मानने में मौलिक रूप से असहमत हैं।

Mahammad Namazov, Tomáš Koref, Ivan Habernal2026-04-08
💬 NLP

From Reasoning to Pixels: Benchmarking the Alignment Gap in Unified Multimodal Models

यह शोध पत्र UReason को प्रस्तुत करता है, जो यह प्रदर्शित करता है कि वर्तमान मल्टीमॉडल मॉडलों की एकीकृत वास्तुकला के बावजूद, उनके क्रॉस-मोडल रिप्रजेंटेशन (cross-modal representations) मिसअलाइन्ड रहते हैं, जैसा कि इस आश्चर्यजनक निष्कर्ष से सिद्ध होता है कि इमेज सिंथेसिस कार्यों में डी-कॉन्टेक्स्टुअलाइज्ड जनरेशन (de-contextualized generation), रीजनिंग-गाइडेड जनरेशन (reasoning-guided generation) से बेहतर प्रदर्शन करता है।

Cheng Yang, Chufan Shi, Bo Shui, Yaokang Wu, Muzi Tao, Huijuan Wang, Ivan Yee Lee, Yong Liu, Xuezhe Ma, Taylor Berg-Kirk (…)2026-04-08