💬 NLP

Dual Perspectives in Emotion Attribution: A Generator-Interpreter Framework for Cross-Cultural Analysis of Emotion in LLMs

यह शोधपत्र बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडेल्स) में भावना अभिव्यक्ति की उपेक्षित सांस्कृतिक पृष्ठभूमि को संबोधित करने के लिए एक जनरेटर-इंटरप्रेटर फ्रेमवर्क का प्रस्ताव करता है, जो 15 देशों के क्रॉस-कल्चरल मूल्यांकन के माध्यम से यह प्रकट करता है कि अभिव्यक्ति और व्याख्या दोनों दृष्टिकोण भावना एट्रिब्यूशन प्रदर्शन को महत्वपूर्ण रूप से प्रभावित करते हैं, जिसमें जनरेटर की उत्पत्ति की प्रमुख भूमिका है।

Aizirek Turdubaeva, Uichin Lee2026-04-01
💬 NLP

PolarQuant: Optimal Gaussian Weight Quantization via Hadamard Rotation for LLM Compression

PolarQuant बड़े भाषा मॉडलों (LLMs) के लिए एक पोस्ट-ट्रेनिंग क्वांटाइजेशन विधि है जो ब्लॉक-वाइज नॉर्मलाइजेशन और वॉल्श-हाडामार्ड रोटेशन को लागू करके वेट्स (weights) को लगभग गॉसियन वितरण में बदलने के माध्यम से लगभग लॉसलेस कंप्रेशन प्राप्त करती है, जिससे बिना किसी कैलिब्रेशन डेटा के अत्यधिक सटीक क्वांटाइजेशन सक्षम होता है और डाउनस्ट्रीम INT4 क्वांटाइज़र के लिए एक प्रभावी प्रीप्रोसेसिंग स्टेप के रूप में कार्य करता है।

Caio Vicentino2026-04-01
🤖 AI

GISTBench: Evaluating LLM User Understanding via Evidence-Based Interest Verification

यह शोध पत्र GISTBench प्रस्तुत करता है, जो एक नया बेंचमार्क और सिंथेटिक डेटासेट है जिसे अनुशंसा प्रणालियों (रिकमेंडेशन सिस्टम) में इंटरेक्शन इतिहास से उपयोगकर्ता की रुचियों को निकालने और सत्यापित करने की लार्ज लैंग्वेज मॉडल्स की क्षमता का मूल्यांकन करने के लिए डिज़ाइन किया गया है, जो विषम जुड़ाव संकेतों (हेटरोजीनियस एंगेजमेंट सिग्नल्स) को संभालने में वर्तमान प्रदर्शन संबंधी बाधाओं को उजागर करने के लिए 'इंटरेस्ट ग्राउंडेडनेस' और 'स्पेसिफिसिटी' के नए मेट्रिक्स का उपयोग करता है।

Iordanis Fostiropoulos, Muhammad Rafay Azhar, Abdalaziz Sawwan, Boyu Fang, Yuchen Liu, Jiayi Liu, Hanchao Yu, Qi Guo, Ji (…)2026-04-01
💬 NLP

Designing FSMs Specifications from Requirements with GPT 4.0

यह शोध पत्र एक विशेषज्ञ-केंद्रित, LLM-आधारित ढांचे का प्रस्ताव और मूल्यांकन करता है जो प्राकृतिक भाषा की आवश्यकताओं से फाइनाइट स्टेट मशीनों (Finite State Machines) को स्वचालित रूप से डिजाइन करने और उत्परिवर्तन (mutation) एवं परीक्षण निर्माण के माध्यम से उन्हें सुधारने के लिए GPT-4 का लाभ उठाता है, जिसका उद्देश्य मॉडल-संचालित इंजीनियरिंग की गुणवत्ता में सुधार करना और सिस्टम विफलता के जोखिमों को कम करना है।

Omer Nguena Timo, Paul-Alexis Rodriguez, Florent Avellaneda2026-04-01
🤖 AI

Xuanwu: Evolving General Multimodal Models into an Industrial-Grade Foundation for Content Ecosystems

यह शोध पत्र Xuanwu VL-2B को प्रस्तुत करता है, जो एक 2B-पैरामीटर वाला औद्योगिक-ग्रेड मल्टीमॉडल फाउंडेशन मॉडल है, जो सूक्ष्म दृश्य धारणा (fine-grained visual perception), सामान्य क्षमता प्रतिधारण (general capability retention) और परिनियोजन लागत (deployment costs) के बीच संतुलन बनाते हुए कंटेंट मॉडरेशन और एडवर्सरियल परिदृश्यों में उत्कृष्ट प्रदर्शन प्राप्त करने के लिए एक कॉम्पैक्ट InternViT-300M और Qwen3 1.7B आर्किटेक्चर के साथ एक तीन-चरणीय प्रशिक्षण पाइपलाइन का लाभ उठाता है।

Zhiqian Zhang, Xu Zhao, Xiaoqing Xu, Guangdong Liang, Weijia Wang, Xiaolei Lv, Bo Li, Jun Gao2026-04-01
💬 NLP

SyriSign: A Parallel Corpus for Arabic Text to Syrian Arabic Sign Language Translation

यह शोध पत्र SyriSign को प्रस्तुत करता है, जो सीरियाई अरबी सांकेतिक भाषा के लिए 1,500 वीडियो नमूनों का पहला सार्वजनिक रूप से उपलब्ध समानांतर संग्रह (parallel corpus) है, जिसका उद्देश्य सीरिया में बधिर समुदाय के लिए संचार बाधाओं को दूर करना और टेक्स्ट-टू-साइन अनुवाद अनुसंधान के लिए एक आधारभूत बेंचमार्क के रूप में कार्य करना है।

Mohammad Amer Khalil, Raghad Nahas, Ahmad Nassar, Khloud Al Jallad2026-04-01
💬 NLP

The Thiomi Dataset: A Large-Scale Multimodal Corpus for Low-Resource African Languages

यह शोध पत्र थिओमी डेटासेट (Thiomi Dataset) का परिचय देता है, जो दस अफ्रीकी भाषाओं में 6,01,000 से अधिक टेक्स्ट एनोटेशन और 3,85,000 ऑडियो रिकॉर्डिंग वाला एक बड़े पैमाने का मल्टीमॉडल कॉर्पस है, जो स्पीच और लैंग्वेज मॉडल्स के लिए नए स्टेट-ऑफ-द-आर्ट बेसलाइन स्थापित करता है और ऑटोमैटिक स्पीच रिकग्निशन प्रदर्शन में महत्वपूर्ण सुधार प्रदर्शित करता है।

Hillary Mutisya, John Mugane, Gavin Nyamboga, Brian Chege, Maryruth Gathoni2026-04-01
💬 NLP

Aligning Multimodal Sequential Recommendations via Robust Direct Preference Optimization with Sparse MoE

यह शोधपत्र RoDPO को प्रस्तुत करता है, जो मल्टीमॉडल अनुक्रमिक अनुशंसाओं (multimodal sequential recommendations) के लिए एक सुदृढ़ डायरेक्ट प्रेफरेंस ऑप्टिमाइज़ेशन (Direct Preference Optimization) फ्रेमवर्क है, जो डिटरमिनिस्टिक हार्ड नेगेटिव्स को एक डायनेमिक कैंडिडेट पूल से स्टोकेस्टिक सैंपलिंग द्वारा प्रतिस्थापित करके रैंकिंग प्रदर्शन को बढ़ाता है ताकि फॉल्स नेगेटिव ग्रेडिएंट्स को कम किया जा सके, जबकि वैकल्पिक रूप से कुशल स्केलिंग के लिए एक स्पार्स मिक्सचर-ऑफ-एक्सपर्ट्स (Mixture-of-Experts) एनकोडर का लाभ उठाता है।

Hejin Huang, Jusheng Zhang, Kaitong Cai, Jian Wang, Rong Pan2026-04-01
💬 NLP

Open Machine Translation for Esperanto

यह शोध पत्र एस्पेरांतो के लिए ओपन-सोर्स मशीन ट्रांसलेशन सिस्टम का पहला व्यापक मूल्यांकन प्रस्तुत करता है, जो यह प्रदर्शित करता है कि NLLB परिवार कई भाषा युग्मों में अन्य मॉडलों से बेहतर प्रदर्शन करता है और साथ ही कोड और सर्वश्रेष्ठ प्रदर्शन करने वाले मॉडलों को जनता के लिए जारी करता है।

Ona de Gibert, Lluís de Gibert2026-04-01
💬 NLP

Is my model perplexed for the right reason? Contrasting LLMs' Benchmark Behavior with Token-Level Perplexity

यह शोध पत्र यह मूल्यांकन करने के लिए एक टोकन-स्तरीय परप्लेक्सिटी (perplexity) ढांचे को प्रस्तुत करता है कि क्या एलएलएम (LLMs) भाषाई रूप से प्रासंगिक संकेतों पर निर्भर करते हैं, जो यह प्रकट करता है कि हालांकि महत्वपूर्ण टोकन व्यवहार को प्रभावित करते हैं, मॉडल अंततः अपेक्षित भाषाई तंत्रों से परे ह्यूरिस्टिक्स (heuristics) पर निर्भर करते हैं।

Zoë Prins, Samuele Punzo, Frank Wildenburg, Giovanni Cinà, Sandro Pezzelle2026-04-01