💬 NLP

Evaluating Speech Articulation Synthesis with Articulatory Phoneme Recognition

यह शोध पत्र आर्टिकुलेटरी फोनम रिकग्निशन (उच्चारण संबंधी ध्वनि पहचान) को एक प्रॉक्सी मीट्रिक के रूप में उपयोग करके स्पीच आर्टिकुलेशन सिंथेसिस के मूल्यांकन का प्रस्ताव करता है, जो यह प्रदर्शित करता है कि यह दृष्टिकोण पारंपरिक पॉइंट-वाइज डिस्टेंस मीट्रिक्स की तुलना में उत्पादन की बारीकियों को बेहतर ढंग से पकड़ता है और अधिक सुदृढ़ मूल्यांकन प्रदान करता है।

Vinicius Ribeiro, Yves Laprie2026-05-21
💬 NLP

Playing Devil's Advocate: Off-the-Shelf Persona Vectors Rival Targeted Steering for Sycophancy

यह शोध पत्र प्रदर्शित करता है कि ऑफ-द-शेल्फ पर्सोना स्टीयरिंग वेक्टर्स, जो संदेह या सूक्ष्मता जैसे गुणों को बढ़ावा देते हैं, मॉडल की चापलूसी (सिकोफैंसी) को लक्षित कॉन्ट्रास्टिव एक्टिवेशन एडिशन (CAA) के स्तर तक प्रभावी ढंग से कम करते हैं और साथ ही सही उपयोगकर्ता इनपुट पर सटीकता को बेहतर ढंग से बनाए रखते हैं, जो यह सुझाव देता है कि चापलूसी एक पर्सोना-स्तरीय गुण है न कि एक एकल स्टीयरेबल दिशा।

Ishaan Kelkar, Nebras Alam, Vikram Kakaria, Madhur Panwar, Vasu Sharma, Maheep Chaudhary2026-05-21
💬 NLP

Building a Custom Taxonomy of AI Skills and Tasks from the Ground Up with Job Postings

यह शोधपत्र TaxonomyBuilder प्रस्तुत करता है, जो एक ऐसा ढांचा है जो यह प्रदर्शित करता है कि LLM-संवर्धित क्लस्टरिंग टूल्स के साथ अनफ़िल्टर्ड कॉर्पोरा का उपयोग करने की तुलना में, प्रोसेसिंग से पहले जॉब पोस्टिंग डेटा को फ़िल्टर करने से अधिक स्पष्ट और डोमेन-विशिष्ट AI स्किल टैक्सोनॉमी प्राप्त होती है।

Stephen Meisenbacher, Peter Norlander2026-05-21
💬 NLP

Cross-lingual robustness of LLM-brain alignment and its computational roots

यह अध्ययन प्रदर्शित करता है कि ट्रांसफॉर्मर-आधारित लार्ज लैंग्वेज मॉडल्स स्वाभाविक भाषाई बोध के दौरान कॉर्टिकल और सबकोर्टिकलल मस्तिष्क गतिविधि के साथ सुदृढ़, क्रॉस-लिंग्विस्टिक रूप से स्थिर संरेखण प्रदर्शित करते हैं, जो मुख्य रूप से पदानुक्रमित भविष्य कहनेवाला प्रसंस्करण (hierarchical predictive processing) या रिप्रजेंटेशनल ज्योमेट्री के बजाय वितरित लेक्सिकल-सिमेंटिक पत्राचारों द्वारा संचालित होते हैं।

Ni Yang, Rui He, Philipp Homan, Iris Sommer, Davide Staub, Wolfram Hinzen2026-05-21
💬 NLP

GradeLegal: Automated Grading for German Legal Cases

यह शोध पत्र 27 लार्ज लैंग्वेज मॉडल्स का व्यवस्थित रूप से मूल्यांकन करते हुए जर्मन कानूनी परीक्षाओं के ग्रेडिंग में आने वाली बाधा को संबोधित करता है, जिसमें यह पाया गया है कि तर्क-उन्मुख (reasoning-oriented) मॉडल्स को सैंपल सॉल्यूशंस और रूब्रिक्स के साथ मिलाने से सार्वजनिक कानून (सार्वजनिक विधि) में विशेषज्ञ ग्रेडिंग के प्रभाव को प्रभावी ढंग से प्राप्त किया जा सकता है (यद्यपि आपराधिक कानून में ऐसा कम है) और एन्सेंबलिंग रणनीतियाँ विश्वसनीयता को और अधिक बढ़ा सकती हैं।

Abdullah Al Zubaer, Lorenz Wendlinger, Simon Alexander Nonn, Michael Granitzer, Jelena Mitrovic2026-05-21
💬 NLP

LoCar: Localization-Aware Evaluation of In-Vehicle Assistants through Fine-Grained Sociolinguistic Control

यह शोध पत्र इन-व्हीकल असिस्टेंट्स (in-vehicle assistants) के लिए एक नवीन मूल्यांकन ढांचा प्रस्तुत करता है जो सूक्ष्म कोरियाई सम्मानजनक शब्दावली नियंत्रण और रणनीतिक संवादात्मक विश्वसनीयता के संबंध में वर्तमान लार्ज लैंग्वेज मॉडल्स (Large Language Models) की महत्वपूर्ण कमियों को उजागर करता है, तथा सामान्य सक्षमता से हटकर सटीक, सुरक्षा-उन्मुख भाषाई अनुकूलन की ओर बदलाव का समर्थन करता है।

Seogyeong Jeong, Kiwoong Park, Seyoung Song, Eunsu Kim, Ken E. Friedl, Jaeho Kim, Alice Oh2026-05-21
💬 NLP

WCXB: A Multi-Type Web Content Extraction Benchmark

यह शोध पत्र WCXB को प्रस्तुत करता है, जो उच्च गुणवत्ता वाले एनोटेशन के साथ सात विशिष्ट प्रकारों के 2,008 वेब पृष्ठों का एक व्यापक बेंचमार्क डेटासेट है, जिसे मौजूदा केवल-लेख (article-only) बेंचमार्क की सीमाओं को दूर करने और वर्तमान वेब सामग्री निष्कर्षण प्रणालियों में महत्वपूर्ण प्रदर्शन अंतराल को प्रकट करने के लिए डिज़ाइन किया गया है।

Murrough Foley2026-05-21
💬 NLP

ACL-Verbatim: hallucination-free question answering for research

यह शोध पत्र ACL-Verbatim को प्रस्तुत करता है, जो अनुसंधान के लिए एक भ्रम-मुक्त (hallucination-free) प्रश्न उत्तर प्रणाली है जो उपयोगकर्ता के प्रश्नों को ACL एंथोलॉजी में वर्बेटिम (verbatim) टेक्स्ट स्पैन से मैप करने के लिए एक्सट्रैक्टिव विधियों का उपयोग करती है, जिसे एक नए ग्राउंड ट्रुथ डेटासेट द्वारा समर्थित किया गया है जहाँ 150M-पैरामीटर वाला मॉडर्नबर्ट (ModernBERT) मॉडल अग्रणी LLM एक्सट्रैक्टर्स से बेहतर प्रदर्शन करता है।

Gábor Recski, Szilveszter Tóth, Nadia Verdha, István Boros, Ádám Kovács2026-05-21
💬 NLP

Automated ICD Classification of Psychiatric Diagnoses: From Classical NLP to Large Language Models

यह अध्ययन प्रदर्शित करता है कि फाइन-ट्यून्ड लार्ज लैंग्वेज मॉडल्स, विशेष रूप से e5_large, स्पेनिश मनोरोग मुक्त-पाठ विवरणों को ICD कोड में मैप करने को स्वचालित करने में शास्त्रीय एनएलपी (NLP) विधियों से काफी बेहतर प्रदर्शन करते हैं, जो 145,000 से अधिक रिकॉर्डों के एक डेटासेट पर 0.866 का माइक्रो-एवरेज्ड F1 स्कोर प्राप्त करते हैं।

Fernando Ortega, Raúl Lara-Cabrera, Jorge Dueñas-Lerín, Alejandro de la Torre-Luque, Mercé Salvador Robert, Enrique Baca (…)2026-05-21
💬 NLP

Do LLMs Know What Luxembourgish Borrows? Probing Lexical Neology in Low-Resource Multilingual Models

यह शोध पत्र लक्ज़मबर्ग के लेक्सिकल नियोलॉजी बेंचमार्क, LexNeo-Bench को प्रस्तुत करता है, जो यह प्रदर्शित करता है कि प्रॉम्प्ट्स में संरचित भाषाई ज्ञान ग्राफ़ (knowledge graphs) को इंजेक्ट करने से लो-रिसोर्स कॉन्टैक्ट भाषाओं में लेक्सिकल बोरोिंग्स (lexical borrowings) को वर्गीकृत करने की बड़े भाषा मॉडलों (large language models) की क्षमता में महत्वपूर्ण सुधार होता है, हालांकि नियोलॉजी का पता लगाना चुनौतीपूर्ण बना हुआ है।

Nina Hosseini-Kivanani2026-05-21