💬 NLP

Quantity Convergence, Quality Divergence: Disentangling Fluency and Accuracy in L2 Mandarin Prosody

यह अध्ययन प्रकट करता है कि जहाँ मंदारिन सीखने वाले उन्नत वियतनामी शिक्षार्थी मेजर फ्रेज़ स्तर पर नेटिव-लाइक प्रोसोडिक बाउंड्रीज़ की मात्रा प्राप्त करते हैं, वहीं वे सब्जेक्ट-वर्ब और वर्ब-ऑब्जेक्ट इंटरफेस के बीच नेटिव प्रोसोडिक पदानुक्रम को उलटकर संरचनात्मक मैपिंग में एक निरंतर, गैर-रैखिक विचलन प्रदर्शित करते हैं, जिससे वे सिंटैक्टिक सटीकता के बजाय प्रवाह को प्राथमिकता देते हैं।

Yuqi Shi, Hao Yang, Xiyao Lu, Jinsong Zhang2026-02-27
💬 NLP

Assessing Deanonymization Risks with Stylometry-Assisted LLM Agent

यह शोध पत्र SALA को प्रस्तुत करता है, जो एक स्टाइलोमेट्री-सहायता प्राप्त (stylometry-assisted) LLM एजेंट फ्रेमवर्क है, जो समाचार लेखों में लेखक के अनामिकता निवारण (authorship deanonymization) के जोखिमों का मूल्यांकन करता है और इन जोखिमों को प्रभावी ढंग से कम करने के साथ-साथ पाठ्य अर्थ को संरक्षित करने के लिए एक निर्देशित पुनर्संरचना (guided recomposition) रणनीति प्रस्तावित करता है।

Boyang Zhang, Yang Zhang2026-02-27
💬 NLP

AgentDropoutV2: Optimizing Information Flow in Multi-Agent Systems via Test-Time Rectify-or-Reject Pruning

AgentDropoutV2 एक टेस्ट-टाइम फ्रेमवर्क है जो रिट्रीवल-ऑगमेंटेड करेक्शन और फेल्योर-ड्रिवन इंडिकेटर्स का उपयोग करके त्रुटिपूर्ण एजेंट आउटपुट्स को गतिशील रूप से बीच में रोककर या उन्हें सुधारकर या हटाकर मल्टी-एजेंट सिस्टम के प्रदर्शन को अनुकूलित करता है, जिससे मॉडल को पुन: प्रशिक्षित किए बिना जटिल तर्क कार्यों पर सटीकता को महत्वपूर्ण रूप से बढ़ाया जाता है।

Yutong Wang, Siyuan Xiong, Xuebo Liu, Wenkang Zhou, Liang Ding, Miao Zhang, Min Zhang2026-02-27
💬 NLP

Discourse-Aware Dual-Track Streaming Response for Low-Latency Spoken Dialogue Systems

यह शोध पत्र डिस्कोर्स-अवेयर ड्यूल-ट्रैक स्ट्रीमिंग रिस्पॉन्स (DDTSR) फ्रेमवर्क का प्रस्ताव करता है, जो स्पोकन डायलॉग सिस्टम्स के लिए एक लो-लेटेंसी आर्किटेक्चर है जो समानांतर सुनने, सोचने और बोलने को सक्षम करने के लिए कनेक्टिव-गाइडेड मॉडल सिनर्जी, स्ट्रीमिंग क्रॉस-मोडल कोलैबोरेशन और करिकुलम लर्निंग का उपयोग करता है, जिससे डिस्कोर्स की गुणवत्ता बनाए रखते हुए रिस्पॉन्स लेटेंसी को 19%-51% तक कम किया जा सकता है।

Siyuan Liu, Jiahui Xu, Feng Jiang, Kuang Wang, Zefeng Zhao, Chu-Ren Huang, Jinghang Gu, Changqing Yin, Haizhou Li2026-02-27
💬 NLP

SPARTA: Scalable and Principled Benchmark of Tree-Structured Multi-hop QA over Text and Tables

यह शोध पत्र SPARTA को प्रस्तुत करता है, जो एक स्केलेबल और सिद्धांतवादी ढांचा है जो गहरे मल्टी-हॉप रीजनिंग और जटिल एग्रीगेशन के साथ बड़े पैमाने पर, उच्च-निष्ठा वाले टेबल-टेक्स्ट प्रश्न उत्तर बेंचमार्क को स्वचालित रूप से उत्पन्न करता है, जो मौजूदा बेंचमार्क की तुलना में वर्तमान अत्याधुनिक मॉडलों के प्रदर्शन में महत्वपूर्ण अंतराल को प्रकट करता है।

Sungho Park, Jueun Kim, Wook-Shin Han2026-02-27
⚡ electrical engineering

A Mixture-of-Experts Model for Multimodal Emotion Recognition in Conversations

यह शोध पत्र MiSTER-E का प्रस्ताव करता है, जो एक मॉड्यूलर मिक्सचर-ऑफ-एक्सपर्ट्स फ्रेमवर्क है जो फाइन-ट्यून्ड स्पीच और टेक्स्ट एलएलएम (LLMs) का उपयोग करके मोडैलिटी-विशिष्ट संदर्भ मॉडलिंग को मल्टीमॉडल फ्यूजन से अलग करता है, और स्पीकर आइडेंटिटी पर निर्भर हुए बिना तीन बेंचमार्क इमोशन रिकग्निशन डेटासेट्स पर स्टेट-ऑफ-द-आर्ट प्रदर्शन प्राप्त करता है।

Soumya Dutta, Smruthi Balaji, Sriram Ganapathy2026-02-27
💬 NLP

Scale Can't Overcome Pragmatics: The Impact of Reporting Bias on Vision-Language Reasoning

यह शोध पत्र तर्क देता है कि विजन-लैंग्वेज मॉडल्स की तर्क करने की सीमाएं प्रशिक्षण डेटा में मौजूद एक रिपोर्टिंग बायस (reporting bias) से उत्पन्न होती हैं जो अंतर्निहित सूचनाओं को छोड़ देता है, यह प्रदर्शित करते हुए कि केवल मॉडल या डेटा के आकार को बढ़ाना इस समस्या को दूर नहीं कर सकता और सुधार के लिए ऐसे विवरणों को कैप्चर करने वाले एनोटेशन का जानबूझकर क्यूरेशन करना आवश्यक है।

Amita Kamath, Jack Hessel, Khyathi Chandu, Jena D. Hwang, Kai-Wei Chang, Ranjay Krishna2026-02-27
💬 NLP

The Dark Side of ChatGPT: Legal and Ethical Challenges from Stochastic Parrots and Hallucination

यह शोध पत्र तर्क देता है कि जबकि यूरोपीय संघ एआई विनियमन में अग्रणी है, इसका वर्तमान प्रतिमान लार्ज लैंग्वेज मॉडल के मतिभ्रम (hallucinations) और स्टोकेस्टिक पैरट (stochastic parrot) व्यवहारों से उत्पन्न कानूनी और नैतिक जोखिमों को कम आंकता है, जिसके लिए इन उभरती चुनौतियों को प्रभावी ढंग से कम करने हेतु और अधिक विकास की आवश्यकता है।

Zihao Li2026-02-26
💬 NLP

Emergence of a phonological bias in ChatGPT

यह शोध पत्र यह प्रदर्शित करता है कि ChatGPT एक मानव-समान ध्वन्यात्मक पूर्वाग्रह प्रदर्शित करता है, जिसमें वह विभिन्न भाषाओं में शब्दों की पहचान करने के लिए स्वरों की तुलना में व्यंजनों का प्राथमिकता से उपयोग करता है, जो यह सुझाव देता है कि मानव भाषा अधिग्रहण की तुलना में अपने भिन्न प्रशिक्षण तंत्र के बावजूद ऐसे संज्ञानात्मक गुण बड़े भाषा मॉडलों (large language models) में उभर सकते हैं।

Juan Manuel Toro2026-02-26
💬 NLP

Breaking the HISCO Barrier: Automatic Occupational Standardization with OccCANINE

यह शोध पत्र OccCANINE को प्रस्तुत करता है, जो 15.8 मिलियन बहुभाषी डेटा युग्मों (data pairs) पर फाइन-ट्यून किया गया एक ओपन-सोर्स टूल है जो 96% सटीकता के साथ व्यावसायिक विवरणों को HISCO और अन्य वर्गीकरण प्रणालियों में मैप करने की प्रक्रिया को स्वचालित करता है, जिससे धीमी मैनुअल कोडिंग का स्थान मिलता है और आर्थिक अनुसंधान के लिए उच्च-गुणवत्ता वाले व्यावसायिक डेटा तक पहुंच का लोकतंत्रीकरण होता है।

Christian Møller Dahl, Torben Johansen, Christian Vedel2026-02-26