← नवीनतम पेपर
💬 NLP

VoidPadding: Let [VOID] Handle Padding in Masked Diffusion Language Models so that [EOS] Can Focus on Semantic Termination

यह शोध पत्र VoidPadding का प्रस्ताव करता है, जो एक समर्पित [VOID] टोकन को पैडिंग के लिए पेश करके मास्कड डिफ्यूजन लैंग्वेज मॉडल्स में पैडिंग और टर्मिनेशन भूमिकाओं को अलग करता है, जो [EOS] ओवरफ्लो की समस्याओं को हल करता है और इंस्ट्रक्शन-ट्यून्ड मॉडल्स पर प्रदर्शन और डिकोडिंग दक्षता में महत्वपूर्ण सुधार करता है।

मूल लेखक: Chunyu Liu, Zhengyang Fan, Kaisen Yang, Alex Lamb

प्रकाशित 2026-06-17
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Chunyu Liu, Zhengyang Fan, Kaisen Yang, Alex Lamb

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक रोबोट को कहानियाँ लिखना सिखा रहे हैं। पुराने तरीके में (ऑटोरेग्रेसिव मॉडल्स), रोबोट एक बार में एक शब्द लिखता है, इंसानों की तरह टाइप करते हुए बाएं से दाएं। लेकिन इस नए तरीके में जिसे मास्क्ड डिफ्यूजन (Masked Diffusion) कहा जाता है, रोबोट प्रश्न चिह्नों से भरे एक खाली पन्ने के साथ शुरुआत करता है और एक साथ सभी शब्दों का अनुमान लगाने की कोशिश करता है, और अपनी भविष्यवाणियों को बार-बार सुधारता है जब तक कि कहानी समझ में आने लायक न हो जाए।

समस्या यह है कि जब आप इस रोबोट को सिखाते हैं, तो आपको उसे अभ्यास के उदाहरण देने होते हैं। अभ्यास को कुशल बनाने के लिए, हम छोटी कहानियों को "डमी शब्दों" (dummy words) के साथ भर देते हैं ताकि वे सभी एक ही आकार के पन्ने पर फिट हो सकें।

समस्या: भ्रमित करने वाला "स्टॉप" साइन

अतीत में, शोधकर्ताओं ने [EOS] नामक एक विशेष टोकन का उपयोग "डमी शब्द" के रूप में किया था।

  • इसका काम 1: रोबोट को यह बताना कि, "यहाँ लिखना बंद करो, कहानी पूरी हो गई है।"
  • इसका काम 2: पन्ने पर खाली जगह भरने के लिए इसका उपयोग करना।

पेपर का तर्क है कि [EOS] टोकन को ये दो काम देना ऐसा ही है जैसे किसी ट्रैफिक लाइट से यह उम्मीद करना कि वह स्टॉप साइन (Stop sign) भी बने और निर्माण बाधा (construction barrier) भी।

जब रोबोट अभ्यास कर रहा होता है, तो वह सीखता है कि [EOS] का अर्थ है "इस स्थान को भरें।" लेकिन जब वह वास्तव में एक वास्तविक कहानी लिख रहा होता है, तो वह [EOS] को देखता है और भ्रमित हो जाता है। वह सोचता है, "ओह, मुझे इस जगह को और अधिक [EOS] से भरना चाहिए!" इससे एक गड़बड़ी होती है जिसे [EOS] ओवरफ्लो (overflow) कहा जाता है। रोबोट थोड़ा सा टेक्स्ट लिखता है और फिर पन्ने को "एंड ऑफ सेंटेंस" मार्करों से भरने लगता है, जिससे कहानी बीच में ही कट जाती है।

यह स्थिति तब और खराब हो जाती है जब रोबोट बड़े ब्लॉक्स (बड़े टुकड़ों) में लंबी कहानियाँ लिखने की कोशिश करता है। "स्टॉप" साइन "डमी" संकेतों से इतना भर जाता है कि रोबोट यह पहचान नहीं पाता कि वास्तविक कहानी कहाँ समाप्त हुई।

समाधान: वॉइडपैडिंग (VoidPadding)

लेखक VoidPadding नामक एक सरल समाधान प्रस्तावित करते हैं। वे [VOID] नामक एक नया, अदृश्य टोकन पेश करते हैं।

इसे इस तरह समझें:

  • [VOID] नया "डमी शब्द" है। यह अभ्यास के पन्ने पर खाली जगह को भरता है, लेकिन इसका कोई अर्थ नहीं है। यह एक भूत की तरह है जो जगह तो घेरता है लेकिन बोलता नहीं है।
  • [EOS] अब केवल "स्टॉप" साइन है। इसे सख्ती से केवल यह बताने के लिए सुरक्षित रखा गया है कि कहानी वास्तव में कब समाप्त हुई।

इन भूमिकाओं को अलग करके, रोबोट स्पष्ट रूप से सीखता है:

  1. [VOID] = "यह सिर्फ खाली जगह है, इसे अनदेखा करें।"
  2. [EOS] = "कहानी पूरी हो गई है, अब रुक जाओ।"

यह व्यवहार में कैसे काम करता है

पेपर में दो चतुर तरकीबों का वर्णन किया गया है जो "इन्फरेंस" (जब रोबोट वास्तव में काम कर रहा होता है) के दौरान होती हैं:

  1. "घोस्ट" बैन (The "Ghost" Ban): जब रोबोट एक कहानी बना रहा होता है, तो उसे [VOID] लिखने से सख्ती से रोका जाता है। यदि वह [VOID] का अनुमान लगाने की कोशिश करता है, तो सिस्टम कहता है "नहीं, वह सिर्फ एक भूत है।" यह रोबलेट को गलती से अपनी कहानी को अदृश्य भूतों से भरने से रोकता है।
  2. अर्ली स्टॉप (The Early Stop): क्योंकि [EOS] अब एक शुद्ध "स्टॉप" साइन है, रोबोट इसकी बात सुन सकता है। जैसे ही वह एक स्पष्ट [EOS] संकेत देखता है, वह तुरंत लिखना बंद कर देता है। वह पूरे पन्ने को कचरे से भरने में समय बर्बाद नहीं करता है। यह रोबोट को बहुत तेज़ बनाता है।
  3. कैनवस एक्सपैंडर (The Canvas Expander): कभी-कभी रोबोट जिस पन्ने से शुरू करता है, वह उसकी कहानी के लिए बहुत छोटा होता है। पेपर में VoidExpansion नामक एक तरकीब पेश की गई है। रोबोट उन "भूतिया" संकेतों ([VOID]) को देखता है जो उसने प्रशिक्षण के दौरान सीखे थे। यदि पन्ना बहुत छोटा है, तो [VOID] संकेत "असहज" दिखेंगे (जैसे कोई भूत एक छोटे से बॉक्स में घुसने की कोशिश कर रहा हो)। रोबोट इसे महसूस करता है, पन्ने का आकार बढ़ा देता है, और फिर कहानी पूरी करता है।

परिणाम

लेखकों ने गणित और कोडिंग पहेलियों का उपयोग करके दो अलग-अलग रोबोट मॉडल (LLaDA और Dream) पर इनका परीक्षण किया।

  • बेहतर गुणवत्ता: जब रोबोट लंबी उत्तर लिखने की कोशिश करते थे, तो पुराना तरीका अक्सर विफल हो जाता था और बस "एंड ऑफ सेंटेंस" बार-बार लिख देता था। नया तरीका (VoidPadding) इस समस्या को हल कर देता है, जिससे उत्तर लंबे और सही रहते हैं।
  • तेज़: क्योंकि रोबोट ठीक वहीं रुक जाते थे जहाँ वे समाप्त हुए थे (पूरे पन्ने को भरने के बजाय), वे कार्यों को औसतन 55% तेज़ी से पूरा कर लेते हैं।
  • मजबूत (Robust): नया तरीका तब भी अच्छी तरह काम करता था जब रोबोट छोटे या लंबे उत्तर लिख रहा हो, या चाहे वह छोटे टुकड़ों में काम कर रहा हो या बड़े टुकड़ों में।

सारांश

पेपर दिखाता है कि "स्टॉप" साइन और "खाली जगह" भरने वाले को दो अलग नाम देकर, हम रोबोट को भ्रमित होने से रोक सकते हैं। इससे रोबोट बेहतर लिखता है, सही समय पर रुकता है, और बहुत तेज़ी से काम करता है। यह रोबोट को सिखाने के तरीके में एक छोटा सा बदलाव है जो उसके प्रदर्शन में बड़ा सुधार लाता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →