💬 NLP

Elderly-Contextual Data Augmentation via Speech Synthesis for Elderly ASR

यह शोध पत्र एक डेटा ऑग्मेंटेशन पाइपलाइन का प्रस्ताव करता है जो वृद्ध संदर्भ वाले सिंथेटिक डेटा को उत्पन्न करने के लिए वृद्ध संदर्भ वक्ताओं के उपयोग के साथ LLM-आधारित ट्रांसक्रिप्ट पैराफ्रेसिंग को TTS सिंथेसिस के साथ जोड़ता है, जो कम-संसाधन वाले वृद्ध भाषण डेटासेट पर Whisper ASR मॉडल के प्रदर्शन में महत्वपूर्ण सुधार करता है।

Minsik Lee, Seoi Hong, Chongmin Lee, Sieun Choi, Jian Kim, Jua Han, Jihie Kim2026-04-29
💬 NLP

GAIA-v2-LILT: Multilingual Adaptation of Agent Benchmark beyond Translation

यह शोध पत्र GAIA-v2-LILT को प्रस्तुत करता है, जो GAIA बेंचमार्क का एक कठोरता से पुन: ऑडिट किया गया बहुभाषी विस्तार है, जो कार्यात्मक संरेखण, सांस्कृतिक अनुकूलन और कठिनाई अंशांकन को संयोजित करने वाले एक परिष्कृत वर्कफ़्लो का उपयोग करता है ताकि यह प्रदर्शित किया जा सके कि न्यूनतम मशीन अनुवाद एजेंट प्रदर्शन मेट्रिक्स को महत्वपूर्ण रूप से विकृत करता है और उचित स्थानीयकरण बहुभाषी प्रदर्शन अंतराल को पर्याप्त रूप से कम करता है।

Yunsu Kim, Kaden Uhlig, Joern Wuebker2026-04-29
🤖 machine learning

Rethinking Layer Redundancy in Large Language Models: Calibration Objectives and Search for Depth Pruning

यह शोध पत्र तर्क देता है कि लार्ज लैंग्वेज मॉडल्स में लेयर रिडंडेंसी (परत अतिरेक) एक अंतर्निहित संरचनात्मक गुण नहीं है बल्कि यह कैलिब्रेशन उद्देश्य पर कार्यात्मक रूप से निर्भर है, जो यह प्रदर्शित करता है कि विशिष्ट सर्च एल्गोरिदम के उपयोग की तुलना में उद्देश्य का चयन डेप्थ प्रूनिंग परिणामों पर अधिक प्रभाव डालता है।

Minkyu Kim, Vincent-Daniel Yun, Youngrae Kim, Youngjin Heo, Suin Cho, Seong-hun Kim, Woosang Lim, Gaeul Kwon2026-04-29
💬 NLP

Independent-Component-Based Encoding Models of Brain Activity During Story Comprehension

यह शोध पत्र एक स्वतंत्र घटक-आधारित एन्कोडिंग फ्रेमवर्क प्रस्तावित करता है जो fMRI डेटा को कार्यात्मक नेटवर्क में विघटित करके पारंपरिक वोक्सेल-वार (voxelwise) दृष्टिकोणों की सीमाओं को दूर करता है, जिससे प्राकृतिक कहानी सुनने के प्रति तंत्रिका संबंधी प्रतिक्रियाओं का सुदृढ़, व्याख्या योग्य और अंतर-विषय तुलना संभव हो पाती है।

Kamya Hari, Taha Binhuraib, Jin Li, Cory Shain, Anna A. Ivanova2026-04-29
💬 NLP

BenchGuard: Who Guards the Benchmarks? Automated Auditing of LLM Agent Benchmarks

यह शोधपत्र बेंचगार्ड (BenchGuard) को प्रस्तुत करता है, जो एक स्वचालित ऑडिटिंग फ्रेमवर्क है जो टास्क-ओरिएंटेड एजेंट बेंचमार्क में दोषों को व्यवस्थित रूप से पहचानने और उन्हें मान्य करने के लिए फ्रंटियर एलएलएम (LLM) का लाभ उठाता है, जो कम लागत पर मानवीय समीक्षा द्वारा छूट जाने वाली महत्वपूर्ण त्रुटियों का पता लगाने में इसकी प्रभावशीलता को प्रदर्शित करता है।

Xinming Tu (Minta), Tianze Wang (Minta), Yingzhou (Minta), Lu, Kexin Huang, Yuanhao Qu, Sara Mostafavi2026-04-29
🤖 machine learning

PolyKV: A Shared Asymmetrically-Compressed KV Cache Pool for Multi-Agent LLM Inference

PolyKV एक नवीन प्रणाली है जो कई समवर्ती (concurrent) LLM इन्फरेंस एजेंटों को एक एकल, एसिमेट्रिकल रूप से कंप्रेस्ड KV कैश पूल साझा करने में सक्षम बनाती है—जिसमें कीज़ (Keys) के लिए int8 क्वांटाइजेशन और वैल्यूज़ (Values) के लिए 3-बिट FWHT-आधारित क्वांटाइजेशन का उपयोग किया गया है—जो विभिन्न मॉडल स्केल्स और कॉन्टेक्स्ट लेंथ्स में उच्च आउटपुट गुणवत्ता बनाए रखते हुए, नगण्य परप्लेक्सिटी गिरावट के साथ 97.7% तक मेमोरी रिडक्शन प्राप्त करती है।

Ishan Patel, Ishan Joshi2026-04-29
💬 NLP

Dynamic Decision Learning: Test-Time Evolution for Abnormality Grounding in Rare Diseases

यह शोध पत्र डायनेमिक डिसीजन लर्निंग (DDL) को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो फ्रोजन लार्ज विजन-लैंग्वेज मॉडल्स को भाषा और दृश्य स्थानों में निर्णयों को पुनरावृत्ति से परिष्कृत करके दुर्लभ रोगों में असामान्यताओं को मजबूती से ग्राउंड करने के लिए उन्नत करता है, जिससे बिना किसी सुपरवाइज्ड फाइन-ट्यूनिंग की आवश्यकता के लोकलाइजेशन सटीकता और कॉन्फिडेंस कैलिब्रेशन में महत्वपूर्ण सुधार होता है।

Jun Li, Mingxuan Liu, Jiazhen Pan, Che Liu, Wenjia Bai, Cosmin I. Bercea, Julia A. Schnabel2026-04-29
💬 NLP

Dont Stop Early: Scalable Enterprise Deep Research with Controlled Information Flow and Evidence-Aware Termination

यह शोध पत्र एक स्केलेबल एंटरप्राइज डीप रिसर्च (EDR) आर्किटेक्चर प्रस्तावित करता है जो असमान कवरेज और समयपूर्व रुकने की समस्याओं को दूर करने के लिए रिफ्लेक्शन के साथ आउटलाइन जनरेशन, डिपेंडेंसी-गाइडेड कॉन्टेक्स्ट लोकलाइजेशन और एविडेंस-बेस्ड टर्मिनेशन क्राइटेरिया का उपयोग करता है, जो आंतरिक सेल्स इनेबलमेंट कार्यों और सार्वजनिक बेंचमार्क दोनों पर बेहतर प्रदर्शन प्रदर्शित करता है।

Prafulla Kumar Choubey, Kung-Hsiang Huang, Pranav Narayanan Venkit, Jiaxin Zhang, Vaibhav Vats, Yu Li, Xiangyu Peng, Chi (…)2026-04-29
💬 NLP

Leverage Laws: A Per-Task Framework for Human-Agent Collaboration

यह शोध पत्र मानव-एजेंट सहयोग के लिए एक मानदण्डिक "लीवरेज रेशियो" (leverage ratio) ढांचे का प्रस्ताव करता है जो विस्थापित मानव कार्य की तुलना विशिष्टता (specification), व्यवधान समाधान और समीक्षा की समय लागत से करके दक्षता को परिमाणित करता है, जबकि यह विश्लेषण करता है कि सूचना प्रवाह संबंधी बाधाएं और कार्य की नवीनता कैसे प्रति-कार्य और विंडो आधारित लीवरेज स्केलिंग को सीमित करती हैं।

Stan Loosmore2026-04-29
💬 NLP

Analyzing LLM Reasoning to Uncover Mental Health Stigma

यह शोध पत्र एक नवीन ढांचे का प्रस्ताव करता है जो केवल उनके अंतिम आउटपुट के बजाय बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) के मध्यवर्ती तर्क चरणों का विश्लेषण करता है, ताकि उस छिपे हुए मानसिक स्वास्थ्य कलंक (मेंटल हेल्थ स्टिग्मा) को उजागर और वर्गीकृत किया जा सके जिसे पारंपरिक बहुविकल्पीय मूल्यांकन पकड़ने में विफल रहते हैं।

Sreehari Sankar, Aliakbar Nafar, Mona Barman, Hannah K. Heitz, Ashwin Kumar, Pouria Tohidi, Dailun Li, Danish Hussain, R (…)2026-04-29