💬 NLP

Reliable Multilingual Orthopedic Decision Support from Clinical Narratives: Language-Aware Adaptation and Verification-Guided Deferral

यह शोध पत्र अंग्रेजी, हिंदी और पंजाबी में बहुभाषी ऑर्थोपेडिक निर्णय सहायता के लिए एक विश्वसनीयता-उन्मुख ढांचे को प्रस्तुत करता है जो शून्य-शॉट (zero-shot) LLMs और मानक बेसलाइनों की तुलना में बेहतर वर्गीकरण प्रदर्शन और मजबूती प्राप्त करने के लिए एक डोमेन-अनुकूली IndicBERT-HPA मॉडल और एक सत्यापन-निर्देशित विलंब (verification-guided deferral) तंत्र का लाभ उठाता है।

Danish Ali, Li Xiaojian, Sundas Iqbal, Farrukh Zaidi2026-06-01
💬 NLP

UniAudio-Token: Empowering Semantic Speech Tokenizers with General Audio Perception

UniAudio-Token, संरचित पर्यवेक्षण (structured supervision) के लिए सिमेंटिक-अकॉस्टिक प्रिमिटिव्स (Semantic-Acoustic Primitives) और ध्वनिक विवरणों को पुनर्स्थापित करने के लिए एक सिमेंटिक-अकॉस्टिक इक्विलिब्रियम गेटिंग मैकेनिज्म (Semantic-Acoustic Equilibrium gating mechanism) को पेश करके सामान्य ऑडियो धारणा क्षमताओं के साथ सिमेंटिक स्पीच टोकनाइज़र को बढ़ाता है, जिससे यह समझ और निर्माण दोनों कार्यों में मौजूदा सिंगल-कोडबुक बेसलाइन से बेहतर प्रदर्शन करते हुए एक एकीकृत ऑडियो इंटरफ़ेस प्राप्त करता है।

Yuhan Song, Linhao Zhang, Aiwei Liu, Chuhan Wu, Sijun Zhang, Wei Jia, Yuan Liu, Houfeng Wang, Xiao Zhou2026-06-01
💬 NLP

Preference-Aware Rubric Learning for Personalized Evaluation

यह शोध पत्र PARL को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो एक स्व-सत्यापित (self-validating), विभेदक सुदृढीकरण शिक्षण (discriminative reinforcement learning) दृष्टिकोण के माध्यम से उपयोगकर्ता के इंटरैक्शन इतिहास से प्राथमिकता-जागरूक रूब्रिक्स (preference-aware rubrics) को सीधे सीखकर मौजूदा व्यक्तिगत मूल्यांकन विधियों की सीमाओं को संबोधित करता है ताकि उपयोगकर्ता-संरेखित LLM प्रतिक्रियाओं का विश्वसनीय, सुसंगत और सूक्ष्म-स्तरीय मूल्यांकन सुनिश्चित किया जा सके।

Yilun Qiu, Xiaoyan Zhao, Yang Zhang, Yuxin Chen, Cilin Yan, Jiayin Cai, Xiaolong Jiang, Yao Hu, Yoko Yamakata, Tat-Seng (…)2026-06-01
💬 NLP

Vision-Language Models Suppress Female Representations Under Ambiguous Input

यह शोध पत्र यह प्रकट करता है कि जहाँ विजन-लैंग्वेज मॉडल अक्सर अस्पष्ट छवियों के लिए आंतरिक रूप से महिला संघों को एनकोड करते हैं, वहीं उनके आउटपुट व्यवस्थित रूप से पुरुष निरूपणों की ओर डिफ़ॉल्ट होते हैं क्योंकि एक विषम फ़िल्टरिंग तंत्र जनरेशन के दौरान पुरुष संकेतों को बढ़ाता है और महिला संकेतों को दबा देता है।

Arnau Marin-Llobet, Simon Henniger, Mahzarin R. Banaji2026-06-01
💬 NLP

Language Models Learn Constructional Semantics, Not To Mention Syntax: Investigating LM Understanding of Paired-Focus Constructions

यह शोध पत्र प्रदर्शित करता है कि मध्यम आकार के ओपन-सोर्स भाषा मॉडल दुर्लभ युग्मित-केंद्रित (paired-focus) संरचनाओं के अर्थों को प्रभावी ढंग से समझ सकते हैं, जिसमें यह समझ सिंटैक्टिक ज्ञान की तुलना में प्रशिक्षण के बाद उभरती है और विश्व ज्ञान के विशिष्ट क्षेत्रों में होने वाली वृद्धि के साथ सह-संबंधित है।

Wesley Scivetti, Ethan Wilcox, Nathan Schneider, Kanishka Misra, Leonie Weissweiler2026-06-01
🤖 AI

A Survey on Recent Advances in Conversational Data Generation

यह शोध पत्र सिंथेटिक संवादात्मक डेटा जनरेशन में हालिया प्रगति का एक व्यापक सर्वेक्षण प्रस्तुत करता है, जो ओपन-डोमेन, कार्य-उन्मुख और सूचना-खोज प्रणालियों में मल्टी-टर्न संवादों को बनाने की विधियों की व्यवस्थित रूप से समीक्षा करता है, साथ ही एक सामान्य ढांचे, मूल्यांकन मेट्रिक्स, वर्तमान चुनौतियों और भविष्य की अनुसंधान दिशाओं को रेखांकित करता है।

Heydar Soudani, Roxana Petcu, Evangelos Kanoulas, Faegheh Hasibi2026-05-29
🤖 machine learning

Early Detection of Misinformation for Infodemic Management: A Domain Adaptation Approach

यह शोध पत्र इन्फोडेमिक्स के दौरान गलत सूचनाओं का शीघ्र पता लगाने के लिए एक नवीन डोमेन अनुकूलन दृष्टिकोण प्रस्तावित करता है जो सैद्धांतिक और अनुभवजन्य रूप से मौजूदा अत्याधुनिक विधियों से बेहतर प्रदर्शन करने के लिए कोवेरिएट और कॉन्सेप्ट दोनों बदलावों को संबोधित करने की आवश्यकता को प्रदर्शित करता है।

Minjia Mao, Xiaohang Zhao, Xiao Fang2026-05-29
💻 computer science

CriticalKV: Optimizing KV Cache Eviction from an Output Perturbation Perspective

यह शोधपत्र CriticalKV को प्रस्तुत करता है, जो एक औपचारिक रूप से आधारित, प्लग-एंड-प्ले एल्गोरिदम है जो आउटपुट परटर्बेशन (output perturbation) का विश्लेषण करके महत्वपूर्ण प्रविष्टियों की पहचान करने द्वारा KV कैश इविक्शन (eviction) को अनुकूलित करता है, जिससे विभिन्न लॉन्ग-कॉन्टेक्स्ट बेंचमार्क में नगण्य कम्प्यूटेशनल ओवरहेड के साथ संपीड़न हानि (compression loss) को काफी कम किया जा सकता है।

Yuan Feng, Junlin Lv, Haoyu Guo, Yukun Cao, S Kevin Zhou, Xike Xie2026-05-29
💬 NLP

Towards Detecting Persuasion on Social Media: From Model Development to Insights on Persuasion Strategies

यह शोध पत्र ऑस्ट्रेलियाई चुनाव फेसबुक विज्ञापनों पर फाइन-ट्यून किए गए एक हल्के, अत्याधुनिक मॉडल को प्रस्तुत करता है जो फंडिंग, जनसांख्यिकी और समय के माध्यम से विशिष्ट अनुनय रणनीतियों (persuasion strategies) को प्रकट करने के लिए है, जिससे डिजिटल अभियानों में पारदर्शिता और मतदाता जागरूकता बढ़ती है।

Elyas Meguellati, Stefano Civelli, Pietro Bernardelle, Shazia Sadiq, Irwin King, Gianluca Demartini2026-05-29
⚡ electrical engineering

Survey of End-to-End Multi-Speaker Automatic Speech Recognition for Monaural Audio

यह सर्वेक्षण एकल-चैनल बहु-वक्ता स्वचालित भाषण पहचान (मोनोरल मल्टी-स्पीकर एएसआर) के लिए एंड-टू-एंड न्यूरल दृष्टिकोणों की एक व्यापक समीक्षा और व्यवस्थित वर्गीकरण प्रदान करता है, जो वास्तुशिल्प प्रतिमानों, हालिया एल्गोरिदम सुधारों, दीर्घ-रूप भाषण विस्तारों और बेंचमार्क प्रदर्शन का विश्लेषण करते हुए भविष्य की अनुसंधान दिशाओं को रेखांकित करता है।

Xinlu He, Jacob Whitehill2026-05-29