💬 NLP

Pairwise Evaluation of Accent Similarity in Speech Synthesis

यह शोध पत्र स्पीच सिंथेसिस में लहजे की समानता के लिए उन्नत व्यक्तिपरक और वस्तुनिष्ठ मूल्यांकन विधियों का प्रस्ताव करता है, जिसमें एक परिष्कृत XAB लिसनिंग टेस्ट और उच्चारण-आधारित मेट्रिक्स पेश किए गए हैं, साथ ही कम प्रतिनिधित्व वाले लहजों के लिए वर्ड एरर रेट जैसे मानक मेट्रिक्स की सीमाओं को रेखांकित किया गया है।

Jinzuomu Zhong, Suyuan Liu, Dan Wells, Korin Richmond2026-02-06
💬 NLP

POLAR: A Benchmark for Multilingual, Multicultural, and Multi-Event Online Polarization

यह शोध पत्र POLAR को प्रस्तुत करता है, जो ऑनलाइन ध्रुवीकरण के लिए एक व्यापक बहुभाषी और बहुसांस्कृतिक बेंचमार्क डेटासेट है, और विभिन्न भाषा मॉडलों की क्षमताओं का मूल्यांकन करता है, जिससे यह पता चलता है कि हालांकि वे ध्रुवीकरण का पता लगा सकते हैं, लेकिन वे विशिष्ट प्रकारों और अभिव्यक्तियों की पहचान करने के जटिल कार्यों में संघर्ष करते हैं।

Usman Naseem, Robert Geislinger, Juan Ren, Sarah Kohail, Rudy Garrido Veliz, P Sam Sahil, Yiran Zhang, Marco Antonio Str (…)2026-02-06
💬 NLP

Verifying the Verifiers: Unveiling Pitfalls and Potentials in Fact Verifiers

यह अध्ययन 14 बेंचमार्क में 13 तथ्य सत्यापन मॉडलों का मूल्यांकन करता है, जो यह प्रकट करता है कि डेटासेट एनोटेशन त्रुटियां रैंकिंग को महत्वपूर्ण रूप से प्रभावित करती हैं, फ्यू-शॉट फ्रंटियर एलएलएम (LLMs) विशिष्ट सत्यापनकर्ताओं से बेहतर प्रदर्शन करते हैं, और छोटे फाइन-ट्यून किए गए मॉडलों को सिंथेटिक मल्टी-हॉप डेटा के माध्यम से जटिल तर्क के लिए उन्नत किया जा सकता है।

Wooseok Seo, Seungju Han, Jaehun Jung, Benjamin Newman, Seungwon Lim, Seungbeen Lee, Ximing Lu, Yejin Choi, Youngjae Yu2026-02-06
💬 NLP

STACK: Adversarial Attacks on LLM Safeguard Pipelines

यह शोध पत्र STACK एडवरसैरियल अटैक प्रक्रिया का परिचय देता है, जो एक नए फ्यू-शॉट-प्रॉम्प्टेड (few-shot-prompted) LLM सुरक्षा तंत्र को 71% अटैक सक्सेस रेट के साथ सफलतापूर्वक समझौता करता है, जिससे वर्तमान फ्रंटियर एआई रक्षा प्रणालियों में महत्वपूर्ण कमजोरियों को उजागर किया जा सके और विशिष्ट समाधान प्रस्तावित किए जा सकें।

Ian R. McKenzie, Oskar J. Hollinsworth, Tom Tseng, Xander Davies, Stephen Casper, Aaron D. Tucker, Robert Kirk, Adam Gle (…)2026-02-06
💬 NLP

Segmentation-free Goodness of Pronunciation

यह शोधपत्र सेगमेंटेशन-मुक्त गुडनेस ऑफ प्रोनंसिएशन (GOP) विधियों (GOP-SA और GOP-SF) का प्रस्ताव करता है जो गलत उच्चारण का पता लगाने में प्री-सेगमेंटेशन की सीमाओं को दूर करने के लिए CTC-प्रशिक्षित ध्वनिक मॉडलों का लाभ उठाते हैं, जिससे फोनीम-स्तर के उच्चारण मूल्यांकन पर अत्याधुनिक परिणाम प्राप्त होते हैं।

Xinwei Cao, Zijian Fan, Torbjørn Svendsen, Giampiero Salvi2026-02-06
💬 NLP

GTPO and GRPO-S: Token and Sequence-Level Reward Shaping with Policy Entropy

यह शोध पत्र GTPO और GRPO-S को प्रस्तुत करता है, जो दो नवीन सुदृढीकरण शिक्षण (reinforcement learning) एल्गोरिदम हैं जो सूक्ष्म-स्तरीय (fine-grained), टोकन-स्तरीय और अनुक्रम-स्तरीय क्रेडिट असाइनमेंट प्राप्त करने के लिए गतिशील एंट्रॉपी-आधारित रिवॉर्ड शेपिंग को लागू करके लार्ज लैंग्वेज मॉडल रीजनिंग को उन्नत करते हैं, जिससे GRPO और DAPO जैसी मौजूदा विधियों की स्थूल-स्तरीय (coarse-grained) सीमाओं को दूर किया जा सके।

Hongze Tan, Zihan Wang, Jianfei Pan, Jinghao Lin, Hao Wang, Yifan Wu, Tao Chen, Zhihang Zheng, Zhihao Tang, Haihua Yang2026-02-06
💬 NLP

When Are Two RLHF Objectives the Same?

यह शोध पत्र ओपल (Opal) को प्रस्तुत करता है, जो एक कैनोनिकलाइजेशन एल्गोरिदम है जो RLHF प्राथमिकता उद्देश्यों की बीजगणितीय समानता (algebraic equivalence) को निर्धारित करता है, जिससे यह प्रकट होता है कि कई व्यापक रूप से उपयोग की जाने वाली विधियाँ वास्तव में एक ही अंतर्निहित लक्ष्य के पुनर्रूपण (reparameterizations) हैं, और साथ ही उन विशिष्ट संरचनात्मक तंत्रों की पहचान करता है जो वास्तव में भिन्न उद्देश्यों का निर्माण करते हैं।

Madhava Gaikwad2026-02-06
💬 NLP

Patterns in the Transition From Founder-Leadership to Community Governance of Open Source

637 गिटहब रिपॉजिटरी और उनके विकसित होते शासन दस्तावेजों का विश्लेषण करके, यह अध्ययन प्रकट करता है कि संस्थापक-नेतृत्व से सामुदायिक शासन में सफल संक्रमण स्वर संबंधी बदलावों के माध्यम से नहीं, बल्कि संस्थागत भूमिकाओं और पारिस्थितिकी तंत्र-स्तर के नियमों के क्रमिक स्तरण और परिष्करण के माध्यम से होता है।

Mobina Noori, Mahasweta Chakraborti, Amy X Zhang, Seth Frey2026-02-06
💬 NLP

Why Tree-Style Branching Matters for Thought Advantage Estimation in GRPO

यह शोध पत्र सैद्धांतिक और अनुभवजन्य रूप से यह प्रदर्शित करता है कि GRPO में, प्रत्येक विचार (thought) प्रति नमूना लिए गए उत्तरों की संख्या (ब्रांचिंग) को बढ़ाना, विचार-स्तरीय लाभ अनुमान (thought-level advantage estimation) में विचलन (variance) को समाप्त करने के लिए एक आवश्यक तंत्र है, जबकि केवल नमूने लिए गए विचारों की संख्या बढ़ाना इसे प्राप्त नहीं कर सकता है, जिससे ब्रांचिंग को स्थिर और कुशल तर्क अनुकूलन (reasoning optimization) के लिए अनिवार्य स्थापित किया गया है।

Hongcheng Wang, Yinuo Huang, Sukai Wang, Guanghui Ren, Hao Dong2026-02-06
💬 NLP

Pattern Enhanced Multi-Turn Jailbreaking: Exploiting Structural Vulnerabilities in Large Language Models

यह शोध पत्र पैटर्न एनहांस्ड चेन ऑफ अटैक (PE-CoA) प्रस्तुत करता है, जो पांच विशिष्ट संवादात्मक पैटर्नों का उपयोग करने वाला एक फ्रेमवर्क है जो बड़े भाषा मॉडलों (LLMs) में संरचनात्मक कमजोरियों का व्यवस्थित रूप से शोषण करता है, यह प्रकट करते हुए कि सुरक्षात्मक बचाव पैटर्न-विशिष्ट होते हैं और विभिन्न हानिकारक श्रेणियों में सामान्यीकृत नहीं होते हैं।

Ragib Amin Nihal, Rui Wen, Kazuhiro Nakadai, Jun Sakuma2026-02-06