💬 NLP

An Investigation of Linguistic Biases in LLM-Based Recommendations

यह अध्ययन दक्षिणी अमेरिकी, भारतीय और कोड-स्विच्ड हिंदी-अंग्रेजी बोलियों में एलएलएम-आधारित (LLM-based) रेस्तरां और उत्पाद अनुशंसाओं में भाषाई पूर्वाग्रहों की जांच करता है, जो यह प्रकट करता है कि विशिष्ट मॉडल परिवार भारतीय अंग्रेजी और कोड-स्विच्ड प्रॉम्प्ट के प्रति अत्यधिक संवेदनशीलता प्रदर्शित करते हैं, जिससे केवल मॉडल के आकार के आधार पर सुसंगत रुझानों के बिना विशिष्ट भिन्नताएं उत्पन्न होती हैं।

Nitin Venkateswaran, Jason Ang, Deep Adhikari, Tarun Krishna Dasari2026-04-29
💬 NLP

PSP: An Interpretable Per-Dimension Accent Benchmark for Indic Text-to-Speech

यह शोध पत्र PSP (फोनीम सब्स्टीट्यूशन प्रोफाइल) प्रस्तुत करता है, जो एक व्याख्यात्मक, प्रति-आयाम बेंचमार्क है जो रेट्रोफ्लेक्शन और एस्पिरेशन जैसे विशिष्ट लहजे के लक्षणों पर इंडिक टेक्स्ट-टू-स्पीच सिस्टम का मूल्यांकन करता है, जिससे यह पता चलता है कि वर्तमान वाणिज्यिक और ओपन-सोर्स लीडर्स उच्च मानक बोधगम्यता स्कोर के बावजूद इन ध्वन्यात्मक बारीकियों को पकड़ने में अक्सर विफल रहते हैं।

Venkata Pushpak Teja Menta2026-04-29
💬 NLP

From Chatbots to Confidants: A Cross-Cultural Study of LLM Adoption for Emotional Support

यह अध्ययन सात देशों में भावनात्मक सहायता के लिए एलएलएम (LLM) अपनाने का पहला बड़े पैमाने पर क्रॉस-सांस्कृतिक विश्लेषण प्रस्तुत करता है, जो जनसांख्यिकीय कारकों और सांस्कृतिक संदर्भों द्वारा संचालित उपयोग दरों और धारणाओं में महत्वपूर्ण विविधताओं को प्रकट करता है, साथ ही उन विविध भावनात्मक आवश्यकताओं को भी उजागर करता है जिन्हें उपयोगकर्ता इन प्रणालियों के माध्यम से संबोधित करना चाहते हैं।

Natalia Amat-Lefort, Mert Yazan, Amanda Cercas Curry, Flor Miriam Plaza-del-Arco2026-04-29
💬 NLP

Marco-MoE: Open Multilingual Mixture-of-Expert Language Models with Efficient Upcycling

मार्को-MoE एक पूर्णतः खुला, अत्यधिक स्पार्स बहुभाषी मिक्चर-ऑफ-एक्सपर्ट्स मॉडल सुइट है जो डेंसर प्रतिस्पर्धियों की तुलना में अत्याधुनिक प्रदर्शन-से-कंप्यूट अनुपात और विभिन्न भाषाओं में बेहतर स्केलेबिलिटी प्राप्त करने के लिए कुशल अपसाइक्लिंग का लाभ उठाता है।

Fan Jiang, Yu Zhao, Chenyang Lyu, Tianqi Shi, Yichao Du, Feihu Jiang, Longyue Wang, Weihua Luo2026-04-29
💬 NLP

Bye Bye Perspective API: Lessons for Measurement Infrastructure in NLP, CSS and LLM Evaluation

यह शोध पत्र अब बंद हो रहे प्रोप्राइटरी पर्सपेक्टिव एपीआई (Perspective API) पर एनएलपी (NLP) और एलएलएम (LLM) अनुसंधान की संरचनात्मक निर्भरता की आलोचना करता है, जो इसके अपारदर्शी अपडेट और विषाक्तता के एकल परिचालनकरण द्वारा उत्पन्न अप्रतिलिपि प्रस्तुत करने योग्य परिणामों को रेखांकित करता है, और भविष्य में इसी तरह के ज्ञानमीमांसीय जोखिमों को रोकने के लिए एक स्वतंत्र, वैध और प्रतिलिपि प्रस्तुत करने योग्य माप अवसंरचना की स्थापना का आह्वान करता है।

David Hartmann, Manuel Tonneau, Angelie Kraft, LK Seiling, Dimitri Staufer, Pieter Delobelle, Jan Fillies, Anna Ricarda (…)2026-04-29
💬 NLP

The Surprising Universality of LLM Outputs: A Real-Time Verification Primitive

यह शोध पत्र एक अल्ट्रा-फास्ट, केवल CPU-आधारित स्कोरिंग प्रिमिटिव प्रस्तुत करता है जो LLM आउटपुट के सार्वभौमिक दो-पैरामीटर मैंडेलब्रॉट रैंक-फ्रीक्वेंसी वितरण का लाभ उठाता है ताकि मौजूदा सैंपलिंग-आधारित डिटेक्टरों की तुलना में 100,000 गुना कम विलंबता (latency) के साथ सांख्यिकीय मॉडल फिंगरप्रिंटिंग और ब्लैक-बॉक्स आउटपुट मूल्यांकन को सक्षम किया जा सके।

Alex Bogdan, Adrian de Valois-Franklin2026-04-29
💬 NLP

Progressing beyond Art Masterpieces or Touristic Clichés: how to assess your LLMs for cultural alignment?

यह शोध पत्र नए डिज़ाइन दिशानिर्देशों का प्रस्ताव करके, एक संगत डेटासेट का निर्माण करके और यह प्रदर्शित करके कि यह दृष्टिकोण सांस्कृतिक रूप से विशिष्ट मॉडलों के बीच अंतर करने में अधिक विभेदक परिणाम देता है, लार्ज लैंग्वेज मॉडल्स के सांस्कृतिक संरेखण के आकलन के लिए मौजूदा डेटासेट्स की सीमाओं को संबोधित करता है।

António Branco, João Silva, Nuno Marques, Luis Gomes, Ricardo Campos, Raquel Sequeira, Sara Nerea, Rodrigo Silva, Miguel (…)2026-04-29
💬 NLP

LLM-ReSum: A Framework for LLM Reflective Summarization through Self-Evaluation

यह शोध पत्र LLM-ReSum को प्रस्तुत करता है, जो एक स्व-चिंतनशील (self-reflective) सारांशीकरण ढांचा है जो मॉडल फाइनट्यूनिंग के बिना तथ्यात्मक सटीकता और कवरेज को महत्वपूर्ण रूप से सुधारने के लिए LLM-आधारित जनरेशन और मूल्यांकन के बीच एक क्लोज्ड फीडबैक लूप का लाभ उठाता है, जिसे मौजूदा मेट्रिक्स के व्यापक मेटा-मूल्यांकन और एक नए कानूनी दस्तावेज़ बेंचमार्क द्वारा समर्थित किया गया है।

Huyen Nguyen, Haoxuan Zhang, Yang Zhang, Junhua Ding, Haihua Chen2026-04-29
💬 NLP

Modeling Human-Like Color Naming Behavior in Context

यह शोध पत्र NeLLCom-Lex ढांचे में दुर्लभ रंग शब्दों के अपसैंपलिंग (upsampling) और मल्टी-लिसनर सुदृढीकरण शिक्षण (multi-listener reinforcement learning) अंतःक्रियाओं को प्रस्तुत करता है, जो यह प्रदर्शित करता है कि इन कारकों को पर्यवेक्षित शिक्षण (supervised learning) के साथ संयोजित करने से ऐसे न्यूरल एजेंट कलर लेक्सिकॉन (color lexicons) प्राप्त होते हैं जो अधिक सूचनात्मक और ज्यामितीय रूप से उत्तल (geometrically convex) होते हैं, और मानव जैसे रंग श्रेणियों के काफी करीब होते हैं।

Yuqing Zhang, Ecesu Ürker, Tessa Verhoef, Gemma Boleda, Arianna Bisazza2026-04-29
💬 NLP

Cross-Lingual Jailbreak Detection via Semantic Codebooks

यह शोध पत्र एक प्रशिक्षण-मुक्त, भाषा-निरपेक्ष जेलब्रेक डिटेक्शन विधि प्रस्तावित करता है जो बहुभाषी क्वेरी एम्बेडिंग्स की तुलना दुर्भावनापूर्ण प्रॉम्प्ट्स के एक निश्चित अंग्रेजी कोडबुक से करता है, और यह प्रदर्शित करता है कि जबकि सिमेंटिक समानता विभिन्न भाषाओं में कैनोनिकल टेम्पलेट्स पर हमलों को प्रभावी ढंग से कम करती है, विविध और विषम असुरक्षित व्यवहारों से जुड़े वितरण बदलावों (डिस्ट्रीब्यूशन शिफ्ट्स) के तहत इसका प्रदर्शन काफी घट जाता है।

Shirin Alanova, Bogdan Minko, Sabrina Sadiekh, Evgeniy Kokuykin2026-04-29