💬 NLP

Who Wrote This Line? Evaluating the Detection of LLM-Generated Classical Chinese Poetry

यह शोधपत्र चांगआन (ChangAn) को प्रस्तुत करता है, जो 30,000 से अधिक शास्त्रीय चीनी कविताओं से युक्त एक व्यापक बेंचमार्क है, जिसका उद्देश्य मानव-लिखित कविता और एलएलएम (LLM) द्वारा निर्मित कृतियों के बीच अंतर करने में वर्तमान एआई (AI) डिटेक्टरों की प्रभावशीलता का मूल्यांकन करना है, जो इस विशिष्ट साहित्यिक क्षेत्र के लिए मौजूदा पहचान उपकरणों की महत्वपूर्ण सीमाओं को प्रकट करता है।

Jiang Li, Tian Lan, Shanshan Wang, Dongxing Zhang, Dianqing Lin, Guanglai Gao, Derek F. Wong, Xiangdong Su2026-04-14
💬 NLP

Training-Free Cross-Lingual Dysarthria Severity Assessment via Phonological Subspace Analysis in Self-Supervised Speech Representations

यह शोध पत्र स्वस्थ नियंत्रण डेटा का उपयोग करके फ्रोजन (frozen) HuBERT रिप्रजेंटेशन्स में ध्वन्यात्मक विशेषताओं के क्षरण को मापकर डिसार्थ्रिया (dysarthria) की गंभीरता का आकलन करने के लिए एक प्रशिक्षण-मुक्त, क्रॉस-लिंगुअल पद्धति प्रस्तुत करता है, जो बिना किसी लेबल वाली रोग संबंधी वाणी की आवश्यकता के पांच भाषाओं और तीन एटियोलॉजी (etiologies) में नैदानिक गंभीरता के साथ महत्वपूर्ण सहसंबंध प्रदर्शित करता है।

Bernard Muller, Antonio Armando Ortiz Barrañón, LaVonne Roberts2026-04-14
🤖 AI

Learning from Emptiness: De-biasing Listwise Rerankers with Content-Agnostic Probability Calibration

यह शोध पत्र CapCal को प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त (training-free) ढांचा है जो कंटेंट-अग्नोस्टिक प्लेसहोल्डर्स का उपयोग करके लॉजिट्स (logits) को कैलिब्रेट करके जनरेटिव लिस्टवाइज रीरैंकर्स से अंतर्निहित स्थिति पूर्वाग्रह (intrinsic position bias) को यांत्रिक रूप से अलग करता है, जिससे बिना किसी इन्फरेंस लेटेंसी के रैंकिंग प्रदर्शन और हल्के मॉडल दक्षता में महत्वपूर्ण सुधार होता है।

Hang Lv, Hongchao Gu, Ruiqing Yang, Liangyue Li, Zulong Chen, Defu Lian, Hao Wang, Enhong Chen2026-04-14
💬 NLP

ODUTQA-MDC: A Task for Open-Domain Underspecified Tabular QA with Multi-turn Dialogue-based Clarification

यह शोध पत्र ODUTQA-MDC कार्य और बेंचमार्क प्रस्तुत करता है, जिसमें एक बड़े पैमाने का डेटासेट और एक मल्टी-एजेंट फ्रेमवर्क (MAIC-TQA) शामिल है जिसे मल्टी-टर्न डायलॉग-आधारित स्पष्टीकरण के माध्यम से कम-निर्दिष्ट ओपन-डोमेन टैबुलर प्रश्नों को संबोधित करने के लिए डिज़ाइन किया गया है।

Zhensheng Wang, ZhanTeng Lin, Wenmian Yang, Kun Zhou, Yiquan Zhang, Weijia Jia2026-04-14
💬 NLP

Relational Probing: LM-to-Graph Adaptation for Financial Prediction

यह शोध पत्र "रिलेशनल प्रोबिंग" (Relational Probing) पेश करता है, जो एक ऐसी विधि है जो डाउनस्ट्रीम स्टॉक-ट्रेंड प्रेडिक्शन कार्यों के साथ संयुक्त प्रशिक्षण के लिए हिडन स्टेट्स से सीधे रिलेशनल ग्राफ्स को प्रेरित करने हेतु मानक लैंग्वेज मॉडल हेड्स को एक रिलेशन हेड से बदल देती है, जो छोटे लैंग्वेज मॉडल्स का उपयोग करते हुए प्रतिस्पर्धी इन्फरेंस लागत के साथ निरंतर प्रदर्शन सुधार प्रदर्शित करती है।

Yingjie Niu, Changhong Jin, Rian Dolphin, Ruihai Dong2026-04-14
💬 NLP

Hijacking Text Heritage: Hiding the Human Signature through Homoglyphic Substitution

यह शोध पत्र होमोग्लिफिक प्रतिस्थापन (homoglyphic substitution) का उपयोग करने का प्रस्ताव देता है, जो मानक वर्णों को विभिन्न लिपियों से दृश्य रूप से समान विकल्पों के साथ बदल देता है, जिसे शैलीमितीय विश्लेषण (stylometric analysis) को कम करने और लिखित पाठ से व्यक्तिगत जानकारी के अनुमान को रोकने के लिए एक प्रतिकूल तकनीक के रूप में उपयोग किया जाता है।

Robert Dilworth2026-04-14
💬 NLP

Comparative Analysis of Large Language Models in Healthcare

यह अध्ययन चिकित्सा कार्यों पर विभिन्न लार्ज लैंग्वेज मॉडल्स का एक मानकीकृत तुलनात्मक मूल्यांकन प्रदान करता है, जो यह प्रकट करता है कि जहाँ डोमेन-विशिष्ट मॉडल प्रासंगिक विश्वसनीयता में और सामान्य-उद्देश्य वाले मॉडल संरचित सटीकता में उत्कृष्ट हैं, वहीं स्वास्थ्य सेवा में उनके सुरक्षित एकीकरण के लिए कार्य-विशिष्ट मूल्यांकन और मानवीय निरीक्षण की आवश्यकता है।

Subin Santhosh, Farwa Abbas, Hussain Ahmad, Claudia Szabo2026-04-14
💬 NLP

Adaptive Multi-Expert Reasoning via Difficulty-Aware Routing and Uncertainty-Guided Aggregation

यह शोध पत्र एडेप्टिव मल्टी-एक्सपर्ट रीजनिंग (AMR) को प्रस्तुत करता है, जो एक ऐसा फ्रेमवर्क है जो अनुमानित कठिनाई और अनिश्चितता के आधार पर समस्याओं को विशिष्ट विशेषज्ञों तक गतिशील रूप से रूट करके गणितीय तर्क की मजबूती को बढ़ाता है, और अंततः सिंथेटिक डेटा पर प्रशिक्षित समान आकार के मॉडलों की तुलना में GSM8K पर बेहतर सटीकता प्राप्त करता है।

Mohamed Ehab, Ali Hamdi2026-04-14
💬 NLP

A Structured Clustering Approach for Inducing Media Narratives

यह शोधपत्र एक संरचित क्लस्टरिंग ढांचे को प्रस्तुत करता है जो स्केलेबल और व्याख्या योग्य नैरेटिव स्कीमा (कथा संरचनाओं) को प्रेरित करने के लिए घटनाओं और पात्रों को संयुक्त रूप से मॉडल करता है, जो प्रभावी रूप से कम्प्यूटेशनल विश्लेषण और संचार सिद्धांत में जोर दिए गए सूक्ष्म कहानी संरचनाओं के बीच के अंतर को पाटता है।

Rohan Das, Advait Deshmukh, Alexandria Leto, Zohar Naaman, I-Ta Lee, Maria Leonor Pacheco2026-04-14
💬 NLP

NameBERT: Scaling Name-Based Nationality Classification with LLM-Augmented Open Academic Data

यह शोधपत्र NameBERT को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो कम प्रतिनिधित्व वाले देशों के लिए सिंथेटिक नामों के साथ एक बड़े पैमाने के Open Academic Graph डेटासेट को संवर्धित करने के लिए बड़े भाषा मॉडलों (LLMs) का लाभ उठाता है, जिसके परिणामस्वरूप एक अत्यधिक सटीक और कुशल राष्ट्रीयता क्लासिफायर प्राप्त होता है जो प्रत्यक्ष LLM इन्फरेंस की कम्प्यूटेशनल लागतों से बचते हुए अत्याधुनिक बेसलाइनों से बेहतर प्रदर्शन करता है।

Cong Ming, Ruixin Shi, Yifan Hu2026-04-14