💬 NLP

Finding Meaning in Embeddings: Concept Separation Curves

यह शोध पत्र कॉन्सेप्ट सेपरेशन कर्व्स (Concept Separation Curves) को प्रस्तुत करता है, जो एक नवीन, क्लासिफायर-स्वतंत्र मूल्यांकन पद्धति है जो कई भाषाओं और डोमेन में सिंटैक्टिक नॉइज़ (syntactic noise) और सिमेंटिक नेगेशन (semantic negations) के प्रति वाक्य एम्बेडिंग्स की प्रतिक्रियाओं को व्यवस्थित रूप से मात्रात्मक रूप से मापकर उनकी वैचारिक स्थिरता का आकलन करता है।

Paul Keuren, Marc Ponsen, Robert Ayoub Bagheri2026-04-24
💬 NLP

Measuring Opinion Bias and Sycophancy via LLM-based Coercion

यह शोध पत्र **llm-bias-bench** प्रस्तुत करता है, जो एक ओपन-सोर्स फ्रेमवर्क है जो एक LLM के वास्तविक राय पूर्वाग्रह और उसकी चापलूसी (sycophancy) की प्रवृत्ति के बीच अंतर करने और उन्हें मापने के लिए विविध उपयोगकर्ता व्यक्तित्वों (personas) के माध्यम से प्रत्यक्ष और अप्रत्यक्ष जांच रणनीतियों का उपयोग करता है, जिससे यह पता चलता है कि तर्कपूर्ण बहस, प्रत्यक्ष प्रश्न पूछने की तुलना में राय की नकल करने की काफी उच्च दर को प्रेरित करती है।

Rodrigo Nogueira, Giovana Kerche Bonás, Thales Sales Almeida, Andrea Roque, Ramon Pires, Hugo Abonizio, Thiago Laitz, Ce (…)2026-04-24
💬 NLP

Process Supervision via Verbal Critique Improves Reasoning in Large Language Models

यह शोध पत्र वर्बल प्रोसेस सुपरविजन (VPS) को प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त ढांचा है जो एक अधिक शक्तिशाली पर्यवेक्षक से प्राप्त संरचित प्राकृतिक-भाषा आलोचनाओं का लाभ उठाकर एक पुनरावृत्ति जनरेट-क्रिटिक-रिफाइन लूप को निर्देशित करता है, जो आलोचना की सूक्ष्मता (granularity) को इन्फरेंस-टाइम स्केलिंग के एक नए अक्ष के रूप में स्थापित करके विविध बेंचमार्क पर तर्क प्रदर्शन में महत्वपूर्ण सुधार करता है।

Hao-Yuan Chen2026-04-24
💬 NLP

Multilinguality at the Edge: Developing Language Models for the Global South

यह शोध पत्र बहुभाषी एनएलपी (NLP) और एज कंप्यूटिंग के प्रतिच्छेदन पर 232 अध्ययनों का सर्वेक्षण करके ग्लोबल साउथ में भाषा मॉडलों को तैनात करने की "लास्ट माइल" चुनौती को संबोधित करता है, जो तकनीकी बाधाओं को दूर करने और न्यायसंगत भाषा प्रौद्योगिकियों को बढ़ावा देने के लिए व्यावहारिक सिफारिशें प्रदान करता है।

Lester James V. Miranda, Songbo Hu, Roi Reichart, Anna Korhonen2026-04-24
💬 NLP

Fine-Grained Perspectives: Modeling Explanations with Annotator-Specific Rationales

यह शोध पत्र एक ऐसे ढांचे का प्रस्ताव करता है जो 'यूज़र पासपोर्ट' तंत्र और दो विशिष्ट 'एक्सप्लेनर आर्किटेक्चर' का लाभ उठाकर एनोटेटर-विशिष्ट लेबल भविष्यवाणियों और स्पष्टीकरणों को संयुक्त रूप से मॉडल करता है, यह प्रदर्शित करते हुए कि सूक्ष्म-स्तरीय तर्कों (rationales) को एकीकृत करने से भविष्य कहनेवाला प्रदर्शन में काफी सुधार होता है और परिप्रेक्ष्य-आधारित असहमति का एक समृद्ध प्रतिनिधित्व प्राप्त होता है।

Olufunke O. Sarumi, Charles Welch, Daniel Braun2026-04-24
💬 NLP

Phonological Subspace Collapse Is Aetiology-Specific and Cross-Lingually Stable: Evidence from 3,374 Speakers

यह अध्ययन प्रदर्शित करता है कि एक प्रशिक्षण-मुक्त ध्वन्यात्मक उपस्थान (phonological subspace) विश्लेषण पद्धति, जिसे 12 भाषाओं और 5 एटियोलॉजी (aetiologies) के 3,374 वक्ताओं पर मान्य किया गया है, व्यक्तिगत स्तर पर वर्गीकरण की सीमाओं के बावजूद, समूह स्तर पर डिसार्थ्रिया (dysarthria) की गंभीरता को चित्रित करने के लिए विशिष्ट, अंतर-भाषाई रूप से स्थिर और आर्किटेक्चर-स्वतंत्र क्षरण प्रोफाइल को मजबूती से पहचानती है।

Bernard Muller, Antonio Armando Ortiz Barrañón, LaVonne Roberts2026-04-24
💬 NLP

Beyond N-gram: Data-Aware X-GRAM Extraction for Efficient Embedding Parameter Scaling

यह शोध पत्र X-GRAM का प्रस्ताव करता है, जो एक फ्रीक्वेंसी-अवेयर डायनेमिक टोकन-इंजेक्शन फ्रेमवर्क है जो लॉन्ग-टेल एम्बेडिंग्स को कंप्रेस करने और लोकल फीचर्स को एक्सट्रैक्ट करने के लिए हाइब्रिड हैशिंग, एलियास मिक्सिंग और डेप्थ-अवेयर गेटिंग का उपयोग करता है, जिससे मॉडल कैपेसिटी को FLOPs से अलग किया जाता है और मेमोरी-ऑगमेंटेड आर्किटेक्चर में सटीकता और पैरामीटर एफिशिएंसी में महत्वपूर्ण सुधार किया जाता है।

Yilong Chen, Yanxi Xie, Zitian Gao, He Xin, Yihao Xiao, Renbiao Liu, Haoming Luo, Yifan Luo, Zhengmao Ye, Tingwen Liu, X (…)2026-04-24
💬 NLP

AUDITA: A New Dataset to Audit Humans vs. AI Skill at Audio QA

यह शोधपत्र AUDITA को प्रस्तुत करता है, जो एक बड़े पैमाने का, मानव-क्यूरेटेड ऑडियो प्रश्न उत्तर बेंचमार्क है जिसे सतही संकेतों से परे गहन श्रवण तर्क (auditory reasoning) का कड़ाई से परीक्षण करने के लिए डिज़ाइन किया गया है, जो यह प्रकट करता है कि वर्तमान अत्याधुनिक मॉडल लंबी अवधि की अस्थायी निर्भरताओं (long-range temporal dependencies) और जटिल अनुमानों की आवश्यकताओं वाले कार्यों पर मनुष्यों की तुलना में काफी खराब प्रदर्शन करते हैं।

Tasnim Kabir, Dmytro Kurdydyk, Aadi Palnitkar, Liam Dorn, Ahmed Haj Ahmed, Jordan Lee Boyd-Graber2026-04-24
💬 NLP

Misinformation Span Detection in Videos via Audio Transcripts

यह शोध पत्र एनोटेटेड ऑडियो ट्रांसक्रिप्ट के दो नए डेटासेट पेश करके वीडियो के भीतर विशिष्ट गलत सूचनाओं को सटीक रूप से पहचानने की चुनौती को संबोधित करता है और यह प्रदर्शित करता है कि अत्याधुनिक भाषा मॉडल 0.68 के F1 स्कोर के साथ इन गलत सूचना स्पैन (misinformation spans) का प्रभावी ढंग से पता लगा सकते हैं।

Breno Matos, Rennan C. Lima, Savvas Zannettou, Fabricio Benevenuto, Rodrygo L. T. Santos2026-04-24
💬 NLP

Learning to Communicate: Toward End-to-End Optimization of Multi-Agent Language Systems

यह शोध पत्र DiffMAS प्रस्तुत करता है, जो एक ऐसा प्रशिक्षण ढांचा है जो लेटेंट कम्युनिकेशन (latent communication) को एक सीखने योग्य घटक मानकर मल्टी-एजेंट सिस्टम को अनुकूलित करता है, जिससे टेक्स्ट-आधारित और पूर्ववर्ती लेटेंट दृष्टिकोणों की तुलना में विविध बेंचमार्क पर तर्क संबंधी सटीकता और स्थिरता में महत्वपूर्ण सुधार होता है।

Ye Yu, Heming Liu, Haibo Jin, Xiaopeng Yuan, Peng Kuang, Haohan Wang2026-04-24