💻 computer science

"Be My Cheese?": Cultural Nuance Benchmarking for Machine Translation in Multilingual LLMs

यह शोध पत्र "Be My Cheese?" को प्रस्तुत करता है, जो बहुभाषी LLMs में सांस्कृतिक स्थानीयकरण का मूल्यांकन करने वाला पहला बड़े पैमाने पर मानव-एनोटेटेड बेंचमार्क है, जो यह प्रकट करता है कि जहाँ अत्याधुनिक मॉडल मामूली व्याकरणिक गुणवत्ता प्राप्त करते हैं, वहीं वे छुट्टियों और सांस्कृतिक अवधारणाओं की तुलना में मुहावरों और पहेलियों जैसे सांस्कृतिक रूप से सूक्ष्म तत्वों के साथ काफी संघर्ष करते हैं।

Madison Van Doren, Casey Ford, Jennifer Barajas, Riley VanMeter, Cory Holland2026-05-29
💻 computer science

DFlash: Block Diffusion for Flash Speculative Decoding

DFlash एक स्पेक्युलेटिव डिकोडिंग फ्रेमवर्क है जो ड्राफ्ट टोकन को समानांतर में जेनरेट करने के लिए एक लाइटवेट ब्लॉक डिफ्यूजन मॉडल का लाभ उठाता है, जिससे 6 गुना से अधिक लॉसलेस त्वरण प्राप्त होता है और यह EAGLE-3 जैसे अत्याधुनिक तरीकों से 2.5 गुना तक बेहतर प्रदर्शन करता है।

Jian Chen, Yesheng Liang, Zhijian Liu2026-05-29
💻 computer science

ValueFlow: Measuring the Propagation of Value Perturbations in Multi-Agent LLM Systems

यह शोधपत्र ValueFlow को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो यह मात्रात्मक रूप से मापता है कि मल्टी-एजेंट LLM सिस्टम के माध्यम से वैल्यू व्यवधान (value perturbations) कैसे प्रसारित होते हैं, यह मान (value) के विचलन को एजेंट-स्तरीय संवेदनशीलता और सिस्टम-स्तरीय संरचनात्मक प्रभावों में विभाजित करके प्रदर्शित करता है, जिससे यह सिद्ध होता है कि वैल्यू अलाइनमेंट मूल रूप से एक सिस्टम-स्तरीय गुण है जो इंटरेक्शन टोपोलॉजी द्वारा आकार लेता है।

Jinnuo Liu, Chuke Liu, Hua Shen2026-05-29
💬 NLP

A Language-Guided Bayesian Optimization for Efficient LoRA Hyperparameter Search

यह शोध पत्र एक भाषा-निर्देशित बेयसियन ऑप्टिमाइज़ेशन (Bayesian Optimization) ढांचे का प्रस्ताव करता है जो प्राकृतिक भाषा प्रॉम्प्ट्स के माध्यम से LoRA हाइपरपैरामीटर्स को एक निरंतर वेक्टर स्पेस में मैप करने के लिए प्री-ट्रेंड LLMs का लाभ उठाता है और डेटा उपसमुच्चयों (subsets) पर प्रॉक्सी ट्रेनिंग का उपयोग करता है ताकि व्यापक खोज (exhaustive search) की तुलना में काफी कम पुनरावृत्तियों (iterations) के साथ उच्च प्रदर्शन करने वाले हाइपरपैरामीटर्स को कुशलतापूर्वक खोजा जा सके।

Baek Seong-Eun, Lee Jung-Mok, Kim Sung-Bin, Tae-Hyun Oh2026-05-29
💬 NLP

Beyond Normalization: Rethinking the Partition Function as a Difficulty Scheduler for RLVR

यह शोध पत्र PACED-RL प्रस्तुत करता है, जो एक पोस्ट-ट्रेनिंग फ्रेमवर्क है जो GFlowNet पार्टीशन फंक्शन को प्रति-प्रॉम्ट सटीकता सिग्नल के रूप में पुनर्व्याख्या करता है ताकि सूचनात्मक प्रॉम्ट्स को प्राथमिकता दी जा सके और रिप्ले को अनुकूलित किया जा सके, जिससे बिना किसी अतिरिक्त कम्प्यूटेशनल ओवरहेड के LLMs में सैंपल दक्षता और रीजनिंग प्रदर्शन में महत्वपूर्ण सुधार होता है।

Dohyung Kim, Minbeom Kim, Jeonghye Kim, Sangmook Lee, Sojeong Rhee, Kyomin Jung2026-05-29
💬 NLP

The Vision Wormhole: Latent-Space Communication in Heterogeneous Multi-Agent Systems

यह शोध पत्र "विज़न वर्महोल" (Vision Wormhole) प्रस्तुत करता है, जो एक यूनिवर्सल विज़ुअल कोडेक का उपयोग करके रीजनिंग ट्रेसेस (reasoning traces) को एक साझा निरंतर स्थान (shared continuous space) में मैप करने के माध्यम से विषम मल्टी-एजेंट सिस्टम के बीच कुशल लेटेंट-स्टेट संचार को सक्षम बनाता है, जिससे अलाइनमेंट जटिलता कम होती है और गति एवं सटीकता दोनों में सुधार होता है।

Xiaoze Liu, Ruowang Zhang, Weichen Yu, Siheng Xiong, Liu He, Feijie Wu, Hoin Jung, Matt Fredrikson, Xiaoqian Wang, Jing (…)2026-05-29
💻 computer science

DLT-Corpus: A Large-Scale Text Collection for the Distributed Ledger Technology Domain

यह शोध पत्र DLT-Corpus प्रस्तुत करता है, जो वैज्ञानिक साहित्य, पेटेंट और सोशल मीडिया से 2.98 बिलियन टोकन का एक बड़े पैमाने का, डोमेन-विशिष्ट टेक्स्ट संग्रह है, जिसका उपयोग यह प्रदर्शित करने के लिए किया जाता है कि DLT अनुसंधान बाजार वृद्धि से पहले आता है और LedgerBERT जैसे उन्नत NLP टूल जारी करना है।

Walter Hernandez Cruz, Peter Devine, Nikhil Vadgama, Paolo Tasca, Jiahua Xu2026-05-29
🤖 AI

Thinking Fast, Thinking Wrong: Intuitiveness Modulates LLM Counterfactual Reasoning in Policy Evaluation

यह शोध पत्र यह प्रदर्शित करता है कि जहाँ चेन-ऑफ-थॉट प्रॉम्प्टिंग सहज नीति मूल्यांकनों (intuitive policy evaluations) पर लार्ज लैंग्वेज मॉडल्स के प्रदर्शन को बढ़ाती है, वहीं सहजता-विरोधी मामलों (counter-intuitive cases) में उनकी प्रतितथ्यात्मक तर्क क्षमता (counterfactual reasoning) सहज पूर्वग्रहों (intuitive priors) को पूरी तरह से ओवरराइड करने में असमर्थता के कारण काफी बाधित रहती है, जो ज्ञान पुनर्प्राप्ति (knowledge retrieval) और तार्किक तर्क (logical reasoning) के बीच एक महत्वपूर्ण अलगाव को प्रकट करती है।

Yanjie He2026-05-29
💻 computer science

What are They Thinking? Delineation, Probing and Tracking of Concepts in LLMs

यह शोध पत्र विभिन्न परतों और संदर्भों में बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) के एम्बेडिंग्स के भीतर विशिष्ट अवधारणाओं को चित्रित करने, पता लगाने और ट्रैक करने के लिए कम लागत वाले, स्केलेबल लीनियर प्रोब्स (linear probes) बनाने के लिए एक ढांचे की रूपरेखा प्रस्तुत करता है, जिससे उनकी व्याख्यात्मकता और निगरानी क्षमताओं को बढ़ाया जा सके।

Mohamed Abdelwahab, Michelle Yu Collins, Sihan Chen, Yi Cheng Zhao, Zafarullah Mahmood, Jiading Zhu, Soliman Ali, Jonath (…)2026-05-29
💻 computer science

RightNow-Arabic-0.5B-Turbo: An Open Sub-1B Arabic Language Model via Vocabulary Injection and Edge-First Deployment

यह शोध पत्र RightNow-Arabic-0.5B-Turbo को प्रस्तुत करता है, जो शब्दावली इंजेक्शन (vocabulary injection) और व्यापक फाइन-ट्यूनिंग के माध्यम से Qwen2.5-0.5B पर निर्मित एक ओपन-सोर्स, 518M-पैरामीटर वाला अरबी-विशेषित भाषा मॉडल है, जो 1B से कम वाले मॉडलों के बीच अत्याधुनिक प्रदर्शन प्राप्त करता है और 400 MB से कम क्वांटाइजेशन के साथ कुशल एज डिप्लॉयमेंट को सक्षम बनाता है।

Jaber Jaber, Osama Jaber2026-05-29