💬 NLP

Factions Within, Uncertain Across: Within-Document Reader Sub-Groups in Social Highlighting

यह अध्ययन प्रकट करता है कि जहाँ पाठक विशिष्ट दस्तावेजों पर साझा सामग्री की प्रमुखता (salience) द्वारा अनुमानित स्तर से अधिक महत्वपूर्ण सहमति के साथ विशिष्ट, गुटीय उप-समूह बनाते हैं, वहीं निरंतर पाठक लक्षणों का पता लगाने के लिए अपर्याप्त सांख्यिकीय शक्ति के कारण विभिन्न दस्तावेजों में इन समूहों की स्थिरता अनसुलझी बनी हुई है।

Kazuki Nakayashiki, Keisuke Watanabe2026-06-11
💬 NLP

Evaluating Bias in Phoneme-Based Automatic Speech Recognition Systems: An Analysis of IPA Transcription Models

यह शोध पत्र मानक और प्रस्तावित सॉफ्ट फोनम एरर रेट्स का उपयोग करके विविध लहजों और भाषाओं में उनके प्रदर्शन का विश्लेषण करके अत्याधुनिक फोनम-आधारित एएसआर सिस्टम (WhisperIPA और ZIPA) में जनसांख्यिकीय पूर्वाग्रहों का मूल्यांकन करता है, जो निरंतर असमानताओं को प्रकट करता है जो अधिक समावेशी और भाषाई रूप से सुदृढ़ मॉडलों की आवश्यकता पर प्रकाश डालता है।

Catherine Bao, Maneesha Rani Saha, Neal Patwari2026-06-11
💬 NLP

3-Key-Input: Exploring the Theoretical Minimum Keys for Text Entry

यह शोध पत्र यह प्रदर्शित करता है कि GPT-4o जैसे एक शक्तिशाली भाषा मॉडल के साथ 3-कुंजी (key) वाले भौतिक कीबोर्ड को संयोजित करने से सामान्य अंग्रेजी टेक्स्ट प्रविष्टि के लिए एक व्यावहारिक न्यूनतम स्तर प्राप्त होता है, जो 2-कुंजी वाली प्रणालियों की तुलना में त्रुटि दरों को काफी कम कर देता है, जबकि अतिरिक्त कुंजियों के साथ मिलने वाले लाभ घटते जाते हैं।

Naoki Kimura2026-06-11
💬 NLP

Improving Cross-Format Robustness in Language Models with Multi-Format Training

यह शोध पत्र यह प्रदर्शित करता है कि मल्टी-फॉर्मेट ट्रेनिंग को शामिल करना, विशेष रूप से कुशल "FormatMix" रणनीति के माध्यम से जो केवल डेटा के एक उपसमूह को विविध उत्तर प्रारूपों के साथ संवर्धित करती है, बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) में कार्य प्रदर्शन और क्रॉस-फॉर्मेट सुदृढ़ता दोनों को महत्वपूर्ण रूप से बढ़ाता है, जो यह सिद्ध करता है कि प्रारूप विविधता केवल अतिरिक्त पर्यवेक्षण की तुलना में अधिक महत्वपूर्ण है।

June M. Liu, Shaomian Zheng, He Cao, Dingnan Jin, Qing Cui, Jun Zhou2026-06-11
💬 NLP

Dummy Backdoor as a Defense: Removing Unknown Backdoors via Shared Internal Mechanisms for Generative LLMs

यह शोध पत्र जनरेटिव LLMs के लिए एक नवीन रक्षा रणनीति का प्रस्ताव करता है जो एक ज्ञात "डमी बैकडोर" को जानबूझकर एम्बेड करके और तत्पश्चात उसे हटाकर अज्ञात बैकडोर्स को कम करता है, जिससे दोनों के बीच साझा आंतरिक सक्रियण तंत्र (internal activation mechanisms) का लाभ उठाते हुए मॉडल की उपयोगिता को बनाए रखते हुए छिपे हुए खतरों को प्रभावी ढंग से निष्प्रभावी किया जा सके।

Kazuki Iwahana, Masaru Matsubayashi, Takuma Koyama, Toshiki Shibahara, Kenichiro Omintato, Akira Ito2026-06-11
💬 NLP

The Long Tail, Not the Front Page: Cold-Start Prediction of Crowd Highlight Salience

यह शोधपत्र प्रदर्शित करता है कि वास्तविक पाठक हाइलाइट डेटा पर प्रशिक्षित एक पर्यवेक्षित मॉडल (supervised model) कोल्ड-स्टार्ट दस्तावेज़ों के लिए क्राउड सैलिएंस (crowd salience) की मजबूती से भविष्यवाणी कर सकता है, जो कि दोनों तुच्छ स्थितिगत बेसलाइन (positional baselines) और अनसुपरवाइज्ड एक्सट्रैक्टिव विधियों से काफी बेहतर प्रदर्शन करता है, और इसका भविष्यवाणात्मक लाभ कम लोकप्रिय सामग्री पर सबसे अधिक स्पष्ट होता है।

Kazuki Nakayashiki, Keisuke Watanabe2026-06-11
💬 NLP

Can AI Reason Like an Urban Planner? Benchmarking Large Language Models Against Professional Judgment

यह शोध पत्र अर्बन प्लानिंग बेंच (UPBench) प्रस्तुत करता है, जो पेशेवर नियोजन निर्णय के विरुद्ध 25 लार्ज लैंग्वेज मॉडल्स का मूल्यांकन करने वाला एक ढांचा है, जो यह प्रकट करता है कि जहाँ एआई विश्लेणात्मक संश्लेषण में उत्कृष्ट है, वहीं यह नियामक भ्रम (रेगुलेटरी हैलुसिनेशन) और प्रैनेटिक कमी (फ़्रोनेटिक डेफिसिट) जैसी विशिष्ट ज्ञानमीमांसीय सीमाओं के कारण संदर्भ-निर्भर नियामक और मानकीय कार्यों में संघर्ष करता है।

Yijie Deng, He Zhu, Wen Wang, Junyou Su, Minxin Chen, Wenjia Zhang2026-06-11
💬 NLP

UR-BERT: Scaling Text Encoders for Massively Multilingual TTS Through Universal Romanization and Speech Token Prediction

यह शोध पत्र UR-BERT प्रस्तुत करता है, जो एक नवीन TTS एनकोडर है जो सार्वभौमिक रोमनकरण के माध्यम से विविध लेखन प्रणालियों को एकीकृत करके और स्पीच टोकन प्रेडिक्शन ऑब्जेक्टिव के माध्यम से ध्वन्यात्मक शुद्धता को बढ़ाकर 495 भाषाओं तक व्यापक बहुभाषी समर्थन को स्केल करता है, जिससे यह पारंपरिक G2P-आधारित दृष्टिकोणों से बेहतर प्रदर्शन करता है और अनदेखी भाषाओं के प्रति मजबूत सामान्यीकरण प्रदर्शित करता है।

Sangmin Lee, Eekgyun Ahn, Woongjib Choi, Hong-Goo Kang2026-06-11
💬 NLP

Layer-Isolated Evaluation: Gating the Deterministic Scaffold of a Production LLM Agent with a No-LLM, Regression-Locked Test Harness

यह शोध पत्र "लेयर-आइसोलेटेड इवैल्यूएशन" (Layer-Isolated Evaluation) को प्रस्तुत करता है, जो एक नियत (deterministic), बिना-LLM वाला टेस्ट हारनेस है जो एक प्रोडक्शन LLM एजेंट को निश्चित परतों में विभाजित करता है ताकि उन प्रतिगमनों (regressions) को सटीक रूप से स्थानीयकृत किया जा सके जिन्हें समग्र एंड-टू-एंड मेट्रिक्स पहचानने में विफल रहते हैं, जैसा कि नियंत्रित इंजेक्शन प्रयोगों द्वारा प्रदर्शित किया गया है जो न्यूनतम समग्र पास दरों द्वारा छिपे हुए महत्वपूर्ण प्रति-स्लाइस प्रदर्शन गिरावट को दर्शाते हैं।

Sawyer Zhang, Alexander Wang, Sophie Lei2026-06-11
💬 NLP

MedCTA: A Benchmark for Clinical Tool Agents

यह शोध पत्र MedCTA प्रस्तुत करता है, जो नैदानिक रूप से सत्यापित, चरण-अंतर्निहित कार्यों पर मेडिकल टूल एजेंटों के मूल्यांकन के लिए एक बेंचमार्क है, जो यह प्रकट करता है कि मजबूत संवेदी क्षमताओं के बावजूद, अत्याधुनिक मल्टीमॉडल मॉडल भी बहु-चरणीय नैदानिक टूल उपयोग में महत्वपूर्ण भंगुरता प्रदर्शित करते हैं।

Tajamul Ashraf, Hyewon Jeong, Fida Mohammad Thoker, Bernard Ghanem2026-06-11