💬 NLP

A Language-Guided Bayesian Optimization for Efficient LoRA Hyperparameter Search

यह शोध पत्र एक भाषा-निर्देशित बेयसियन ऑप्टिमाइज़ेशन (Bayesian Optimization) ढांचे का प्रस्ताव करता है जो प्राकृतिक भाषा प्रॉम्प्ट्स के माध्यम से LoRA हाइपरपैरामीटर्स को एक निरंतर वेक्टर स्पेस में मैप करने के लिए प्री-ट्रेंड LLMs का लाभ उठाता है और डेटा उपसमुच्चयों (subsets) पर प्रॉक्सी ट्रेनिंग का उपयोग करता है ताकि व्यापक खोज (exhaustive search) की तुलना में काफी कम पुनरावृत्तियों (iterations) के साथ उच्च प्रदर्शन करने वाले हाइपरपैरामीटर्स को कुशलतापूर्वक खोजा जा सके।

Baek Seong-Eun, Lee Jung-Mok, Kim Sung-Bin, Tae-Hyun Oh2026-05-29
💬 NLP

Beyond Normalization: Rethinking the Partition Function as a Difficulty Scheduler for RLVR

यह शोध पत्र PACED-RL प्रस्तुत करता है, जो एक पोस्ट-ट्रेनिंग फ्रेमवर्क है जो GFlowNet पार्टीशन फंक्शन को प्रति-प्रॉम्ट सटीकता सिग्नल के रूप में पुनर्व्याख्या करता है ताकि सूचनात्मक प्रॉम्ट्स को प्राथमिकता दी जा सके और रिप्ले को अनुकूलित किया जा सके, जिससे बिना किसी अतिरिक्त कम्प्यूटेशनल ओवरहेड के LLMs में सैंपल दक्षता और रीजनिंग प्रदर्शन में महत्वपूर्ण सुधार होता है।

Dohyung Kim, Minbeom Kim, Jeonghye Kim, Sangmook Lee, Sojeong Rhee, Kyomin Jung2026-05-29
💬 NLP

The Vision Wormhole: Latent-Space Communication in Heterogeneous Multi-Agent Systems

यह शोध पत्र "विज़न वर्महोल" (Vision Wormhole) प्रस्तुत करता है, जो एक यूनिवर्सल विज़ुअल कोडेक का उपयोग करके रीजनिंग ट्रेसेस (reasoning traces) को एक साझा निरंतर स्थान (shared continuous space) में मैप करने के माध्यम से विषम मल्टी-एजेंट सिस्टम के बीच कुशल लेटेंट-स्टेट संचार को सक्षम बनाता है, जिससे अलाइनमेंट जटिलता कम होती है और गति एवं सटीकता दोनों में सुधार होता है।

Xiaoze Liu, Ruowang Zhang, Weichen Yu, Siheng Xiong, Liu He, Feijie Wu, Hoin Jung, Matt Fredrikson, Xiaoqian Wang, Jing (…)2026-05-29
💻 computer science

DLT-Corpus: A Large-Scale Text Collection for the Distributed Ledger Technology Domain

यह शोध पत्र DLT-Corpus प्रस्तुत करता है, जो वैज्ञानिक साहित्य, पेटेंट और सोशल मीडिया से 2.98 बिलियन टोकन का एक बड़े पैमाने का, डोमेन-विशिष्ट टेक्स्ट संग्रह है, जिसका उपयोग यह प्रदर्शित करने के लिए किया जाता है कि DLT अनुसंधान बाजार वृद्धि से पहले आता है और LedgerBERT जैसे उन्नत NLP टूल जारी करना है।

Walter Hernandez Cruz, Peter Devine, Nikhil Vadgama, Paolo Tasca, Jiahua Xu2026-05-29
🤖 AI

Thinking Fast, Thinking Wrong: Intuitiveness Modulates LLM Counterfactual Reasoning in Policy Evaluation

यह शोध पत्र यह प्रदर्शित करता है कि जहाँ चेन-ऑफ-थॉट प्रॉम्प्टिंग सहज नीति मूल्यांकनों (intuitive policy evaluations) पर लार्ज लैंग्वेज मॉडल्स के प्रदर्शन को बढ़ाती है, वहीं सहजता-विरोधी मामलों (counter-intuitive cases) में उनकी प्रतितथ्यात्मक तर्क क्षमता (counterfactual reasoning) सहज पूर्वग्रहों (intuitive priors) को पूरी तरह से ओवरराइड करने में असमर्थता के कारण काफी बाधित रहती है, जो ज्ञान पुनर्प्राप्ति (knowledge retrieval) और तार्किक तर्क (logical reasoning) के बीच एक महत्वपूर्ण अलगाव को प्रकट करती है।

Yanjie He2026-05-29
💻 computer science

What are They Thinking? Delineation, Probing and Tracking of Concepts in LLMs

यह शोध पत्र विभिन्न परतों और संदर्भों में बड़े भाषा मॉडलों (लार्ज लैंग्वेज मॉडल्स) के एम्बेडिंग्स के भीतर विशिष्ट अवधारणाओं को चित्रित करने, पता लगाने और ट्रैक करने के लिए कम लागत वाले, स्केलेबल लीनियर प्रोब्स (linear probes) बनाने के लिए एक ढांचे की रूपरेखा प्रस्तुत करता है, जिससे उनकी व्याख्यात्मकता और निगरानी क्षमताओं को बढ़ाया जा सके।

Mohamed Abdelwahab, Michelle Yu Collins, Sihan Chen, Yi Cheng Zhao, Zafarullah Mahmood, Jiading Zhu, Soliman Ali, Jonath (…)2026-05-29
💻 computer science

RightNow-Arabic-0.5B-Turbo: An Open Sub-1B Arabic Language Model via Vocabulary Injection and Edge-First Deployment

यह शोध पत्र RightNow-Arabic-0.5B-Turbo को प्रस्तुत करता है, जो शब्दावली इंजेक्शन (vocabulary injection) और व्यापक फाइन-ट्यूनिंग के माध्यम से Qwen2.5-0.5B पर निर्मित एक ओपन-सोर्स, 518M-पैरामीटर वाला अरबी-विशेषित भाषा मॉडल है, जो 1B से कम वाले मॉडलों के बीच अत्याधुनिक प्रदर्शन प्राप्त करता है और 400 MB से कम क्वांटाइजेशन के साथ कुशल एज डिप्लॉयमेंट को सक्षम बनाता है।

Jaber Jaber, Osama Jaber2026-05-29
💻 computer science

Aryabhata 2: Scaling Reinforcement Learning for Advanced STEM Reasoning

यह शोध पत्र आर्यभट्ट 2 का परिचय देता है, जो GPT-OSS-20B पर आधारित एक सुदृढीकरण शिक्षण (reinforcement learning) द्वारा प्रशिक्षित भाषा मॉडल है, जो एक उच्च-गुणवत्ता वाले पाठ्यक्रम और प्रगतिशील रोलआउट अन्वेषण (progressive rollout exploration) का लाभ उठाकर JEE और NEET जैसी प्रतिस्पर्धी STEM परीक्षाओं पर उत्कृष्ट प्रदर्शन और अधिक टोकन दक्षता प्राप्त करता है।

Ritvik Rastogi, Vishal Singh, Tejas Chaudhari, Sandeep Varma2026-05-29
💻 computer science

S3Mem: Structured Spatiotemporal Scene-Event Memory for Long-Horizon Interactive Question Answering

यह शोध पत्र S3Mem को प्रस्तुत करता है, जो एक संरचित दृश्य-घटना आधारित एपिसोडिक मेमोरी फ्रेमवर्क है, जो एजेंट प्रक्षेप पथों (trajectories) को संरचित, एंकर-संवेदनशील साक्ष्य इकाइयों में परिवर्तित करके लॉन्ग-होरिज़ोन इंटरैक्टिव प्रश्नोत्तर में मानक रिट्रीवल-ऑगमेंटेड जनरेशन और अन्य बेसलाइनों से बेहतर प्रदर्शन करता है, जिससे सटीकता और टोकन दक्षता में महत्वपूर्ण सुधार होता है।

Encheng Su, Jinouwen Zhang, Jianyu Wu, Qiucheng Yu, Chen Tang, Pengze Li, Lintao Wang, Yizhou Wang, Xinzhu Ma, Shixiang (…)2026-05-29
💻 computer science

GenesisFunc: Multi-Agent Data Generation for Accurate and Generalizable Function-Calling

यह शोध पत्र GenesisFunc को पेश करता है, जो एक मल्टी-एजेंट स्वचालित पाइपलाइन है जो एक 8B LLM को प्रशिक्षित करने के लिए उच्च-गुणवत्ता वाला, विविध सिंथेटिक फंक्शन-कॉलिंग डेटा उत्पन्न करता है, जो समान आकार के ओपन-सोर्स मॉडलों की तुलना में बेहतर इन-डोमेन प्रदर्शन और आउट-ऑफ-डोमेन सामान्यीकरण प्राप्त करता है और उन्नत API-आधारित प्रणालियों का मुकाबला करता है।

Hao-Xiang Xu, Chong Deng, Jiaqing Liu, Wen Wang, Qian Chen, Lujia Bao, Xiangang Li, Zhen-Hua Ling2026-05-29