💬 NLP

Confident in a Confidence Score: Investigating the Sensitivity of Confidence Scores to Supervised Fine-Tuning

यह शोध पत्र इस बात की जांच करता है कि कैसे सुपरवाइज्ड फाइन-ट्यूनिंग (supervised fine-tuning) भाषा मॉडलों में कॉन्फिडेंस स्कोर और आउटपुट गुणवत्ता के बीच के सहसंबंध को कम करती है, यह प्रदर्शित करते हुए कि प्रशिक्षण वितरण की समानता जैसे कारकों के कारण ये मेट्रिक्स 'ऑफ-द-शेल्फ' (off-the-shelf) अविश्वसनीय हो जाते हैं और अधिक मजबूत अनिश्चितता परिमाणीकरण (uncertainty quantification) विधियों की तत्काल आवश्यकता पर प्रकाश डालते हैं।

Lorenzo Jaime Yu Flores, Cesare Spinoso di-Piano, Jackie Chi Kit Cheung2026-04-13
💬 NLP

Quantisation Reshapes the Metacognitive Geometry of Language Models

यह शोध पत्र यह प्रदर्शित करता है कि मॉडल क्वांटाइजेशन (quantization), अंतर्निहित भेदभाव संकेतों (discrimination signals) को प्रभावित किए बिना M-अनुपात सामान्यीकरणों (M-ratio normalizations) को बदलकर, LLMs में डोमेन-स्तरीय मेटाकॉग्निटिव दक्षता प्रोफाइलों को मौलिक रूप से पुनर्गठित करता है, जिससे इन्फरेंस फॉर्मेट (inference format) पर विश्वास-आधारित डायग्नोस्टिक्स की एक महत्वपूर्ण निर्भरता का पता चलता जिसे डोमेन-कंडीशनल ट्रेनिंग के माध्यम से हल नहीं किया जा सकता है।

Jon-Paul Cacioli2026-04-13
💬 NLP

Testing the Assumptions of Active Learning for Translation Tasks with Few Samples

यह शोध पत्र कम नमूनों वाले अनुवाद कार्यों के लिए सक्रिय शिक्षण (active learning) की मूल धारणाओं को इस तथ्य को प्रदर्शित करते हुए चुनौती देता है कि चयनित डेटा की सूचनात्मकता (informatity) और विविधता का प्रदर्शन के साथ कोई सहसंबंध नहीं है, जबकि नमूना क्रम (sample ordering) और प्री-ट्रेनिंग डेटा के साथ अंतःक्रियाएं ही सफलता के प्राथमिक चालक हैं।

Lorenzo Jaime Yu Flores, Cesare Spinoso di-Piano, Ori Ernst, David Ifeoluwa Adelani, Jackie Chi Kit Cheung2026-04-13
💬 NLP

PerMix-RLVR: Preserving Persona Expressivity under Verifiable-Reward Alignment

यह शोध पत्र PerMix-RLVR का प्रस्ताव करता है, जो एक प्रशिक्षण रणनीति है जो रोल-प्लेइंग कार्यों में हानिकारक व्यक्तित्व विविधताओं के विरुद्ध मॉडल की मजबूती को बढ़ाने और उच्च-सटीक व्यक्तित्व अभिव्यक्ति को बनाए रखने के लिए सत्यापन योग्य पुरस्कारों (verifiable rewards) के साथ व्यक्तित्व मिश्रण (persona mixing) को सुदृढीकरण लर्निंग (reinforcement learning) के साथ जोड़ती है।

Jihwan Oh, Soowon Oh, Murad Aghazada, Minchan Jeong, Sungnyun Kim, Se-Young Yun2026-04-13
💬 NLP

Towards Linguistically-informed Representations for English as a Second or Foreign Language: Review, Construction and Application

यह शोध पत्र 1,643 एनोटेटेड वाक्यों के एक नवीन, रचनावादी-आधारित वाक्य-अर्थ संबंधी संसाधन का निर्माण करके अंग्रेजी को दूसरी भाषा या विदेशी भाषा (ESFL) के रूप में समर्पित निरूपणों की आवश्यकता को संबोधित करता है, जो ESFL को एक विशिष्ट भाषाई प्रणाली के रूप में पकड़ता है और भाषाई निकेत परिकल्पना (Linguistic Niche Hypothesis) के एक पायलट अध्ययन के माध्यम से द्वितीय भाषा अधिग्रहण अनुसंधान में इसकी उपयोगिता को प्रदर्शित करता है।

Wenxi Li, Xihao Wang, Weiwei Sun2026-04-13
💬 NLP

Regime-Conditional Retrieval: Theory and a Transferable Router for Two-Hop QA

यह शोध पत्र टू-हॉप QA रिट्रीवल में Q-डोमिनेंट और B-डोमिनेंट रेजीमों के बीच के सैद्धांतिक अंतर को औपचारिक रूप बनाता है और RegimeRouter को पेश करता है, जो एक हल्का, ज़ीरो-शॉट ट्रांसफ़रेबल राउटर है जो अनुकूलतम रिट्रीवल रणनीतियों को गतिशील रूप से चुनने के लिए सरफेस-टेक्स्ट प्रेडिकेट्स का लाभ उठाता है, जिससे बेंचमार्क डेटासेट्स पर रिकॉल में महत्वपूर्ण सुधार होता है।

Andre Bacellar2026-04-13
💬 NLP

SiMing-Bench: Evaluating Procedural Correctness from Continuous Interactions in Clinical Skill Videos

यह शोध पत्र SiMing-Bench को प्रस्तुत करता है, जो मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स की प्रक्रियात्मक शुद्धता (procedural correctness) का मूल्यांकन करने की क्षमता को मापने के लिए पहला बेंचमार्क है, जो यह ट्रैक करता है कि निरंतर अंतःक्रियाएं क्लिनिकल स्किल स्टेट्स को कैसे अपडेट करती हैं, और यह प्रकट करता है कि वर्तमान मॉडल्स इस सूक्ष्म, रूब्रिक-आधारित मूल्यांकन में काफी संघर्ष करते हैं, बावजूद इसके कि वे मोटे तौर पर वैश्विक मूल्यांकन (coarse global evaluations) में सक्षम दिखाई देते हैं।

Xiyang Huang, Jiawei Lin, Keying Wu, Jiaxin Huang, Kailai Yang, Renxiong Wei, Cheng zeng, Jiayi Xiang, Ziyan Kuang, Min (…)2026-04-13
💬 NLP

Hierarchical Alignment: Enforcing Hierarchical Instruction-Following in LLMs through Logical Consistency

यह शोध पत्र न्यूरो-सिम्बोलिक हिरार्किकल अलाइनमेंट (NSHA) का प्रस्ताव करता है, जो एक ऐसा ढांचा है जो इन्फरेंस के दौरान सॉल्वर-गाइडेड कंस्ट्रेंट सेटिस्फेक्शन को डिस्टिलेशन-आधारित प्रशिक्षण के साथ जोड़कर, विभिन्न अधिकार स्तरों वाले निर्देशों के बीच संघर्ष को सुलझाने की लार्ज लैंग्वेज मॉडल्स की क्षमता को बढ़ाता है, जिससे जटिल, बहु-निर्देश परिदृश्यों में तार्किक निरंतरता और कार्य उपयोगिता सुनिश्चित होती है।

Shu Yang, Zihao Zhou, Di Wang, Wenda Li2026-04-13
💬 NLP

Few-Shot Contrastive Adaptation for Audio Abuse Detection in Low-Resource Indic Languages

यह शोध पत्र प्रदर्शित करता है कि CLAP मॉडलों के फ्यू-शॉट सुपरवाइज्ड कॉन्ट्रास्टिव एडाप्टेशन (few-shot supervised contrastive adaptation) से ऑडियो से सीधे कम-संसाधन वाले भारतीय भाषाओं में प्रभावी क्रॉस-लिंगुअल अभद्र भाषण का पता लगाना संभव है, जो पूर्णतः सुपरवाइज्ड सिस्टम के साथ प्रतिस्पर्धी प्रदर्शन प्राप्त करते हुए यह रेखांकित करता है कि अनुकूलन (adaptation) के लाभ भाषाओं के बीच गैर-एकदिष्ट (non-monotonically) रूप से भिन्न होते हैं।

Aditya Narayan Sankaran, Reza Farahbakhsh, Noel Crespi2026-04-13
💬 NLP

Interactive ASR: Towards Human-Like Interaction and Semantic Coherence Evaluation for Agentic Speech Recognition

यह शोध पत्र इंटरैक्टिव स्पीच रिकग्निशन के लिए एक एजेंटिक फ्रेमवर्क का प्रस्ताव करता है जो पारंपरिक वर्ड एरर रेट्स से परे सिमेंटिक कोहेरेंस (अर्थ संबंधी सुसंगतता) का मूल्यांकन करने और मानव-समान मल्टी-टर्न सुधार को सक्षम करने के लिए एलएलएम (LLMs) का लाभ उठाता है, जो कई भाषाओं और बेंचमार्क में बेहतर फिडेलिटी प्रदर्शित करता है।

Peng Wang (X-LANCE Lab, Shanghai Jiao Tong University), Yanqiao Zhu (X-LANCE Lab, Shanghai Jiao Tong University), Zixuan (…)2026-04-13