💬 NLP

Knowledge Editing in Masked Diffusion Language Models

यह शोध पत्र ऑटोरेग्रेसिव मॉडलों से मास्कड डिफ्यूजन मॉडलों में लोकेट-एंड-एडिट नॉलेज एडिटिंग विधियों की हस्तांतरणीयता की जांच करता है, जो यह प्रकट करता है कि हालांकि इष्टतम संपादन स्थान (एडिटिंग लोकेशन) सुसंगत रहता है, डिफ्यूजन मॉडल अन-ऑप्टिमाइज्ड इंटरमीडिएट स्टेट्स के कारण डिग्रेडेड मल्टी-टोकन एडिटिंग प्रदर्शन से ग्रस्त होते हैं—एक ऐसी सीमा जिसे प्रस्तावित सुधार द्वारा प्रभावी ढंग से संबोधित किया गया है जो इन स्टेट्स के लिए एडिट्स को ऑप्टिमाइज़ करता है।

Haewon Park, Yohan Jo2026-06-03
💬 NLP

A Pocket Offline Model for Simultaneous Speech Translation as CUNI Submission to IWSLT 2026

यह शोध पत्र IWSLT 2026 सिमुल्टेनियस स्पीच ट्रांसलेशन शेयर्ड टास्क के लिए CUNI सबमिशन को प्रस्तुत करता है, जो चेक, अंग्रेजी, जर्मन और इतालवी में उच्च गुणवत्ता वाले बहुभाषी सिमुल्टेनियस अनुवाद के लिए कम कम्प्यूटेशनल आवश्यकताओं के साथ AlignAtt पॉलिसी वाले 1B-पैरामीटर ऑफलाइन कैनरी मॉडल को अनुकूलित करता है।

Aziz Sharipov Ortega, Dominik Macháček2026-06-03
⚡ electrical engineering

Efficient ASR Training with Conversations that Never Happened

यह शोध पत्र यह प्रदर्शित करता है कि सीमित वास्तविक संवादात्मक डेटा को LLM-जनित, TTS-संश्लेषित संवादों के साथ संवर्धित करने से कम-संसाधन वाली भाषाओं के लिए ASR प्रदर्शन में महत्वपूर्ण सुधार होता है, जो वास्तविक भाषण के काफी अधिक मात्रा में डेटा पर प्रशिक्षित मॉडल से भी बेहतर प्रदर्शन करता है।

Máté Gedeon, Péter Mihajlik2026-06-03
💬 NLP

AlignAtt4LLM: Fast AlignAtt for Decoder-Only LLMs at IWSLT 2026 Simultaneous Speech Translation Task

यह शोधपत्र AlignAtt4LLM प्रस्तुत करता है, जो एक नवीन समवर्ती भाषण अनुवाद प्रणाली है जो फोर्स्ड अलाइनमेंट (forced alignment), चयनात्मक अटेंशन हेड चयन (selective attention head selection) और क्वेरी/की कैप्चर (query/key capture) का उपयोग करके डिकोडर-ओनली (decoder-only) LLMs के लिए AlignAtt नीति को अनुकूलित करती है, जिससे IWSLT 2026 डेवलपमेंट सेट पर अंग्रेजी-से-जर्मन और अंग्रेजी-से-इतालवी अनुवाद के लिए अत्याधुनिक (state-of-the-art) परिणाम प्राप्त होते हैं।

Quentin Fuxa, Dominik Macháček2026-06-03
💬 NLP

QUBRIC: Co-Designing Queries and Rubrics for RL Beyond Verifiable Rewards

QUBRIC एक अभिनव ढांचा है जो परिदृश्य-आधारित प्रश्नों और शिक्षक-आधारित रूब्रिक्स को सह-डिज़ाइन करके मौजूदा रूब्रिक-आधारित सुदृढीकरण शिक्षण की संरचनात्मक सीमाओं को दूर करता है, जिससे खुले अंत वाले कार्यों पर प्रभावी प्रशिक्षण सक्षम होता है और तर्क एवं निर्देश-अनुपालन बेंचमार्क में महत्वपूर्ण प्रदर्शन लाभ प्राप्त होता है।

Rongzhi Zhang, Rui Feng, Zhihan Zhang, Jingfeng Yang, Qingyu Yin, Xin Liu, Zixuan Zhang, Priyanka Nigam, Bing Yin, Tuo Z (…)2026-06-03
💬 NLP

GottBERT: a pure German Language Model

यह शोध पत्र GottBERT को प्रस्तुत करता है, जो OSCAR डेटासेट पर प्री-ट्रेन किया गया पहला जर्मन एकल-भाषा RoBERTa मॉडल है, जो मौजूदा जर्मन और बहुभाषी मॉडलों की तुलना में विभिन्न NLP कार्यों में प्रतिस्पर्धी प्रदर्शन प्रदर्शित करता है, साथ ही यह भी नोट करता है कि कॉर्पस फ़िल्टरिंग का परिणामों पर न्यूनतम प्रभाव पड़ा।

Raphael Scheible, Johann Frei, Fabian Thomczyk, Henry He, Patric Tippmann, Jochen Knaus, Victor Jaravine, Frank Kramer (…)2026-06-02
💬 NLP

Malaysian English News Decoded: A Linguistic Resource for Named Entity and Relation Extraction

यह शोध पत्र मलेशियाई अंग्रेजी समाचार (MEN) डेटासेट प्रस्तुत करता है, जो 20 समाचार लेखों से 6,061 संस्थाओं और 3,268 संबंधों वाला एक मैन्युअल रूप से एनोटेटेड संसाधन है, जो मलेशियाई अंग्रेजी के लिए अनुकूलित डेटा की कमी को संबोधित करता है और एनएलपी (NLP) मॉडल को फाइन-ट्यून करने के लिए उपयोग किए जाने पर नामित इकाई पहचान (Named Entity Recognition) प्रदर्शन में महत्वपूर्ण सुधार करता है।

Mohan Raj Chanthran, Lay-Ki Soon, Huey Fang Ong, Bhawani Selvaretnam2026-06-02
💬 NLP

OARelatedWork: A Large-Scale Dataset of Related Work Sections with Full-texts from Open Access Sources

यह शोध पत्र OARelatedWork को प्रस्तुत करता है, जो ओपन-एक्सेस स्रोतों से पूर्ण-पाठ (full-text) संबंधित कार्य (related work) निर्माण को सक्षम करने वाला पहला बड़े पैमाने का डेटासेट है, जो यह प्रकट करता है कि जहाँ आधुनिक LLMs सारांशों (abstracts) की तुलना में विशाल संदर्भों को संश्लेषित करने में संघर्ष करते हैं, वहीं वे साक्ष्य-आधारित तथ्यात्मकता में मानव बेसलाइन से बेहतर प्रदर्शन कर सकते हैं, जिससे अपर्याप्त संदर्भ-आधारित मेट्रिक्स के स्थान पर नए कथन-स्तरीय मूल्यांकन ढांचों की आवश्यकता उत्पन्न होती है।

Martin Docekal, Martin Fajcik, Pavel Smrz2026-06-02