💬 NLP

Formalizing building-up constructions of self-dual codes through isotropic lines in Lean

यह शोधपत्र बाइनरी सेल्फ-डुअल कोड्स के किम (Kim) और चिनबर्ग-झांग (Chinburg-Zhang) के निर्माणों के बीच तुल्यता स्थापित करता है, बीजगणितीय और ज्यामितीय दृष्टिकोणों को एकीकृत करने के लिए $-1केएकवर्गहोनेकीशर्तकालाभउठातेहुएपूर्ववर्तीको के एक वर्ग होने की शर्त का लाभ उठाते हुए पूर्ववर्ती को q \equiv 1 \pmod{4}वाले वाले q$-ary क्षेत्रों तक विस्तारित करता है, और विभिन्न इष्टतम एवं MDS सेल्फ-डुअल कोड्स को कुशलतापूर्वक निर्मित करने के लिए इन परिणामों का लीन 4 (Lean 4) औपचारिक रूप प्रदान करता है।

Jae-Hyun Baek, Jon-Lark Kim2026-04-10
💬 NLP

PIArena: A Platform for Prompt Injection Evaluation

प्रॉम्प्ट इंजेक्शन हमलों के लिए एक एकीकृत मूल्यांकन ढांचे की कमी को दूर करने के लिए, लेखक PIArena पेश करते हैं, जो एक विस्तार योग्य प्लेटफॉर्म है जो विविध हमलों और सुरक्षा उपायों के एकीकरण को सुगम बनाता है, जो वर्तमान अत्याधुनिक सुरक्षा प्रणालियों में महत्वपूर्ण सीमाओं, जैसे कि खराब सामान्यीकरण क्षमता और अनुकूलन रणनीतियों के प्रति संवेदनशीलता को प्रकट करता है।

Runpeng Geng, Chenlong Yin, Yanting Wang, Ying Chen, Jinyuan Jia2026-04-10
💬 NLP

sciwrite-lint: Verification Infrastructure for the Age of Science Vibe-Writing

यह शोध पत्र sciwrite-lint को प्रस्तुत करता है, जो एक ओपन-सोर्स, स्थानीय सत्यापन उपकरण है जो संदर्भ अखंडता और उद्धरण समर्थन की जाँच करके वैज्ञानिक पांडुलिपियों को स्वचालित रूप से मान्य करने के लिए एआई (AI) का उपयोग करता है, साथ ही वैज्ञानिक तर्कों की दार्शनिक सुदृढ़ता का कम्प्यूटेशनल रूप से आकलन करने के लिए एक प्रयोगात्मक "SciLint स्कोर" का प्रस्ताव भी करता है।

Sergey V Samsonau2026-04-10
💬 NLP

What Drives Representation Steering? A Mechanistic Case Study on Steering Refusal

यह शोध पत्र इनकार (refusal) पर एक केस स्टडी के माध्यम से बड़े भाषा मॉडलों (large language models) में स्टीयरिंग वेक्टर्स (steering vectors) के कारणत्मक तंत्रों (causal mechanisms) की जांच करता है, जो यह प्रकट करता है कि वे मुख्य रूप से अटेंशन स्कोर्स (attention scores) को नियंत्रित करने के लिए OV सर्किट के साथ परस्पर क्रिया करके कार्य करते हैं, जो महत्वपूर्ण स्पारसिफिकेशन (sparsification) और अर्थपूर्ण रूप से व्याख्या योग्य अवधारणाओं की पहचान की अनुमति देता है।

Stephen Cheng, Sarah Wiegreffe, Dinesh Manocha2026-04-10
💬 NLP

OpenVLThinkerV2: A Generalist Multimodal Reasoning Model for Multi-domain Visual Tasks

OpenVLThinkerV2 एक सुदृढ़, सामान्य-उद्देश्य वाला मल्टीमॉडल रीजनिंग मॉडल है जो इंटर-टास्क ग्रेडिएंट इक्विटी और स्थिरता सुनिश्चित करने के लिए गॉसियन GRPO (G2^2RPO) को पेश करके और सूक्ष्म धारणा (fine-grained perception) के साथ बहु-चरणीय तर्क (multi-step reasoning) को प्रभावी ढंग से संतुलित करने के लिए नवीन रिस्पॉन्स लेंथ और एंट्रॉपी शेपिंग तंत्रों के माध्यम से विविध विजुअल कार्यों में श्रेष्ठ प्रदर्शन प्राप्त करता है।

Wenbo Hu, Xin Chen, Yan Gao-Tian, Yihe Deng, Nanyun Peng, Kai-Wei Chang2026-04-10
💬 NLP

Seeing but Not Thinking: Routing Distraction in Multimodal Mixture-of-Experts

यह शोध पत्र मल्टीमॉडल मिक्स्चर-ऑफ-एक्सपर्ट्स मॉडल्स में "देखना पर न सोचना" (Seeing but Not Thinking) की घटना की पहचान और समाधान करता है, जहाँ विज़ुअल इनपुट्स रूटिंग मैकेनिज्म को कार्य-प्रासंगिक रीजनिंग एक्सपर्ट्स को कम सक्रिय करने के लिए प्रेरित करते हैं, और एक रूटिंग-गाइडेड हस्तक्षेप का प्रस्ताव करता है जो उचित एक्सपर्ट एक्टिवेशन सुनिश्चित करके जटिल विज़ुअल रीजनिंग प्रदर्शन में महत्वपूर्ण सुधार करता है।

Haolei Xu, Haiwen Hong, Hongxing Li, Rui Zhou, Yang Zhang, Longtao Huang, Hui Xue, Yongliang Shen, Weiming Lu, Yueting Z (…)2026-04-10
💬 NLP

Exploring Natural Language-Based Strategies for Efficient Number Learning in Children through Reinforcement Learning

यह शोध पत्र एक सुदृढीकरण शिक्षण (रिनफोर्समेंट लर्निंग) ढांचे को प्रस्तुत करता है जो यह प्रदर्शित करता है कि स्पष्ट भाषाई क्रिया मार्गदर्शन और एक संरचित पाठ्यक्रम बेस-टेन ब्लॉक्स का उपयोग करके संख्या संरचना सीखने की एजेंटों की क्षमता को महत्वपूर्ण रूप से बढ़ाते हैं, जो प्रारंभिक बाल शिक्षा रणनीतियों के लिए बहुमूल्य अंतर्दृष्टि प्रदान करते हैं।

Tirthankar Mittra2026-04-09
💬 NLP

SimSiam Naming Game: A Unified Approach for Representation Learning and Emergent Communication

यह शोध पत्र सिमसियाम नेमिंग गेम (SSNG) का प्रस्ताव करता है, जो एक फीडबैक-मुक्त ढांचा है जो अक्षम सैंपलिंग-आधारित अपडेट को सममित स्व-पर्यवेक्षित प्रतिनिधित्व संरेखण और गमबेल-सॉफ्टमैक्स रिलैक्सेशन से बदल देता है, जिससे एजेंटों को उभरता हुआ संचार सीखने में सक्षम बनाया जा सके जो मौजूदा विधियों की तुलना में जटिल दृश्य डेटासेट पर बेहतर वर्गीकरण प्रदर्शन प्राप्त करता है।

Nguyen Le Hoang, Tadahiro Taniguchi, Fang Tianwei, Akira Taniguchi2026-04-09
💬 NLP

Reward Models Can Improve Themselves: Reward-Guided Adversarial Failure Mode Discovery for Robust Reward Modeling

यह शोध पत्र REFORM को प्रस्तुत करता है, जो एक स्व-सुधार (self-improving) ढांचा है जो रिवॉर्ड-गाइडेड कंट्रोल्ड डिकोडिंग के माध्यम से मॉडल का उपयोग करके स्वयं प्रतिकूल विफलता मोड (adversarial failure modes) उत्पन्न करके रिवॉर्ड मॉडल की मजबूती को बढ़ाता है, जिससे प्रदर्शन से समझौता किए बिना मिसअलाइन्ड व्यवहारों को सुधारने के लिए प्रशिक्षण डेटा को संवर्धित किया जाता है।

Pankayaraj Pathmanathan, Furong Huang2026-04-09
💬 NLP

Soft Head Selection for Injecting ICL-Derived Task Embeddings

यह शोध पत्र SITE को प्रस्तुत करता है, जो एक ग्रेडिएंट-आधारित विधि है जो ICL-व्युत्पन्न एम्बेडिंग्स (embeddings) को इंजेक्ट करने के लिए कार्य-प्रासंगिक अटेंशन हेड्स की पहचान करती है, जो विविध कार्यों और मॉडल स्केल्स पर PEFT की तुलना में कम प्रशिक्षण योग्य पैरामीटर्स की आवश्यकता के साथ मौजूदा एम्बेडिंग-आधारित अनुकूलन और फ्यू-शॉट ICL दृष्टिकोणों से काफी बेहतर प्रदर्शन करती है।

Jungwon Park, Jimyeong Kim, Changin Choi, Wonjong Rhee2026-04-09