💬 NLP

KV Cache Offloading for Context-Intensive Tasks

यह शोध पत्र प्रकट करता है कि मौजूदा KV-कैश ऑफलोडिंग विधियाँ लो-रैंक प्रोजेक्शन और अविश्वसनीय लैंडमार्क्स के कारण नए पेश किए गए Text2JSON बेंचमार्क जैसे संदर्भ-गहन कार्यों पर प्रदर्शन को काफी कम कर देती हैं, और एक सरल वैकल्पिक रणनीति का प्रस्ताव करता है जो कई LLM परिवारों में सटीकता में पर्याप्त सुधार करती है।

Andrey Bocharnikov, Ivan Ermakov, Denis Kuznedelev, Vyacheslav Zhdanovskiy, Yegor Yershov2026-04-10
💬 NLP

AfriVoices-KE: A Multilingual Speech Dataset for Kenyan Languages

AfriVoices-KE एक बड़े पैमाने का, उच्च गुणवत्ता वाला बहुभाषी स्पीच डेटासेट है जिसमें पांच केन्याई भाषाओं के लगभग 5,000 मूल वक्ताओं के लगभग 3,000 घंटों का स्क्रिप्टेड और सहज ऑडियो शामिल है, जिसे स्पीच तकनीक में अफ्रीकी भाषाओं के कम प्रतिनिधित्व को दूर करने और समावेशी ऑटोमैटिक स्पीच रिकग्निशन और टेक्स्ट-टू-स्पीच सिस्टम के विकास में सहायता करने के लिए डिज़ाइन किया गया है।

Lilian Wanzare, Cynthia Amol, zekiel Maina, Nelson Odhiambo, Hope Kerubo, Leila Misula, Vivian Oloo, Rennish Mboya, Edwi (…)2026-04-10
💬 NLP

Entropy-Gradient Grounding: Training-Free Evidence Retrieval in Vision-Language Models

यह शोध पत्र "एन्ट्रॉपी-ग्रेडिएंट ग्राउंडिंग" (Entropy-Gradient Grounding) प्रस्तुत करता है, जो एक प्रशिक्षण-मुक्त विधि है जो जटिल प्रश्नों के लिए साक्ष्य खोजने की विजन-लैंग्वेज मॉडल्स की क्षमता को बढ़ाती है, जो प्रासंगिकता मानचित्र (relevance maps) उत्पन्न करने के लिए नेक्स्ट-टोकन एन्ट्रॉपी को बैकप्रोपैगेट करती है, जिससे बिना किसी सहायक डिटेक्टर के पुनरावृत्ति-आधारित, अनिश्चितता-संचालित दृश्य परिशोधन (visual refinement) सक्षम होता है।

Marcel Gröpl, Jaewoo Jung, Seungryong Kim, Marc Pollefeys, Sunghwan Hong2026-04-10
💬 NLP

Formalizing building-up constructions of self-dual codes through isotropic lines in Lean

यह शोधपत्र बाइनरी सेल्फ-डुअल कोड्स के किम (Kim) और चिनबर्ग-झांग (Chinburg-Zhang) के निर्माणों के बीच तुल्यता स्थापित करता है, बीजगणितीय और ज्यामितीय दृष्टिकोणों को एकीकृत करने के लिए $-1केएकवर्गहोनेकीशर्तकालाभउठातेहुएपूर्ववर्तीको के एक वर्ग होने की शर्त का लाभ उठाते हुए पूर्ववर्ती को q \equiv 1 \pmod{4}वाले वाले q$-ary क्षेत्रों तक विस्तारित करता है, और विभिन्न इष्टतम एवं MDS सेल्फ-डुअल कोड्स को कुशलतापूर्वक निर्मित करने के लिए इन परिणामों का लीन 4 (Lean 4) औपचारिक रूप प्रदान करता है।

Jae-Hyun Baek, Jon-Lark Kim2026-04-10
💬 NLP

PIArena: A Platform for Prompt Injection Evaluation

प्रॉम्प्ट इंजेक्शन हमलों के लिए एक एकीकृत मूल्यांकन ढांचे की कमी को दूर करने के लिए, लेखक PIArena पेश करते हैं, जो एक विस्तार योग्य प्लेटफॉर्म है जो विविध हमलों और सुरक्षा उपायों के एकीकरण को सुगम बनाता है, जो वर्तमान अत्याधुनिक सुरक्षा प्रणालियों में महत्वपूर्ण सीमाओं, जैसे कि खराब सामान्यीकरण क्षमता और अनुकूलन रणनीतियों के प्रति संवेदनशीलता को प्रकट करता है।

Runpeng Geng, Chenlong Yin, Yanting Wang, Ying Chen, Jinyuan Jia2026-04-10
💬 NLP

sciwrite-lint: Verification Infrastructure for the Age of Science Vibe-Writing

यह शोध पत्र sciwrite-lint को प्रस्तुत करता है, जो एक ओपन-सोर्स, स्थानीय सत्यापन उपकरण है जो संदर्भ अखंडता और उद्धरण समर्थन की जाँच करके वैज्ञानिक पांडुलिपियों को स्वचालित रूप से मान्य करने के लिए एआई (AI) का उपयोग करता है, साथ ही वैज्ञानिक तर्कों की दार्शनिक सुदृढ़ता का कम्प्यूटेशनल रूप से आकलन करने के लिए एक प्रयोगात्मक "SciLint स्कोर" का प्रस्ताव भी करता है।

Sergey V Samsonau2026-04-10
💬 NLP

What Drives Representation Steering? A Mechanistic Case Study on Steering Refusal

यह शोध पत्र इनकार (refusal) पर एक केस स्टडी के माध्यम से बड़े भाषा मॉडलों (large language models) में स्टीयरिंग वेक्टर्स (steering vectors) के कारणत्मक तंत्रों (causal mechanisms) की जांच करता है, जो यह प्रकट करता है कि वे मुख्य रूप से अटेंशन स्कोर्स (attention scores) को नियंत्रित करने के लिए OV सर्किट के साथ परस्पर क्रिया करके कार्य करते हैं, जो महत्वपूर्ण स्पारसिफिकेशन (sparsification) और अर्थपूर्ण रूप से व्याख्या योग्य अवधारणाओं की पहचान की अनुमति देता है।

Stephen Cheng, Sarah Wiegreffe, Dinesh Manocha2026-04-10
💬 NLP

OpenVLThinkerV2: A Generalist Multimodal Reasoning Model for Multi-domain Visual Tasks

OpenVLThinkerV2 एक सुदृढ़, सामान्य-उद्देश्य वाला मल्टीमॉडल रीजनिंग मॉडल है जो इंटर-टास्क ग्रेडिएंट इक्विटी और स्थिरता सुनिश्चित करने के लिए गॉसियन GRPO (G2^2RPO) को पेश करके और सूक्ष्म धारणा (fine-grained perception) के साथ बहु-चरणीय तर्क (multi-step reasoning) को प्रभावी ढंग से संतुलित करने के लिए नवीन रिस्पॉन्स लेंथ और एंट्रॉपी शेपिंग तंत्रों के माध्यम से विविध विजुअल कार्यों में श्रेष्ठ प्रदर्शन प्राप्त करता है।

Wenbo Hu, Xin Chen, Yan Gao-Tian, Yihe Deng, Nanyun Peng, Kai-Wei Chang2026-04-10
💬 NLP

Seeing but Not Thinking: Routing Distraction in Multimodal Mixture-of-Experts

यह शोध पत्र मल्टीमॉडल मिक्स्चर-ऑफ-एक्सपर्ट्स मॉडल्स में "देखना पर न सोचना" (Seeing but Not Thinking) की घटना की पहचान और समाधान करता है, जहाँ विज़ुअल इनपुट्स रूटिंग मैकेनिज्म को कार्य-प्रासंगिक रीजनिंग एक्सपर्ट्स को कम सक्रिय करने के लिए प्रेरित करते हैं, और एक रूटिंग-गाइडेड हस्तक्षेप का प्रस्ताव करता है जो उचित एक्सपर्ट एक्टिवेशन सुनिश्चित करके जटिल विज़ुअल रीजनिंग प्रदर्शन में महत्वपूर्ण सुधार करता है।

Haolei Xu, Haiwen Hong, Hongxing Li, Rui Zhou, Yang Zhang, Longtao Huang, Hui Xue, Yongliang Shen, Weiming Lu, Yueting Z (…)2026-04-10
💬 NLP

Exploring Natural Language-Based Strategies for Efficient Number Learning in Children through Reinforcement Learning

यह शोध पत्र एक सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) ढांचे को प्रस्तुत करता है जो यह प्रदर्शित करता है कि स्पष्ट भाषाई क्रिया मार्गदर्शन और एक संरचित पाठ्यक्रम बेस-टेन ब्लॉक्स का उपयोग करके संख्या संरचना सीखने की एजेंटों की क्षमता को महत्वपूर्ण रूप से बढ़ाते हैं, जो प्रारंभिक बाल शिक्षा रणनीतियों के लिए बहुमूल्य अंतर्दृष्टि प्रदान करते हैं।

Tirthankar Mittra2026-04-09