← नवीनतम पेपर
💬 NLP

Lizard: An Efficient Linearization Framework for Large Language Models

Lizard एक नवीन लिनियराइजेशन फ्रेमवर्क है जो प्रीडोन्ड ट्रांसफॉर्मर-आधारित LLMs को एडेप्टिव, लर्नबल मॉड्यूल्स और एक हार्डवेयर-अवेयर एल्गोरिदम का उपयोग करके सबक्वाड्रेटिक आर्किटेक्चर में बदल देता है ताकि क्वाड्रेटिक कॉम्प्लेक्सिटी बॉटलनैक्स को दूर करते हुए पूर्ववर्ती विधियों की तुलना में नियर-लॉसलेस परफॉरमेंस रिकवरी और बेहतर लेंथ जनरलाइजेशन प्राप्त किया जा सके।

मूल लेखक: Chien Van Nguyen, Huy Nguyen, Ruiyi Zhang, Hanieh Deilamsalehy, Puneet Mathur, Viet Dac Lai, Haoliang Wang, Jayakumar Subramanian, Ryan A. Rossi, Trung Bui, Nikos Vlassis, Franck Dernoncourt, Thien Hu
प्रकाशित 2026-04-21
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Chien Van Nguyen, Huy Nguyen, Ruiyi Zhang, Hanieh Deilamsalehy, Puneet Mathur, Viet Dac Lai, Haoliang Wang, Jayakumar Subramanian, Ryan A. Rossi, Trung Bui, Nikos Vlassis, Franck Dernoncourt, Thien Huu Nguyen

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आपके पास एक शानदार, अत्यंत बुद्धिमान लाइब्रेरियन (एक लार्ज लैंग्वेज मॉडल या LLM) है जिसने दुनिया की लगभग हर किताब पढ़ ली है। यह लाइब्रेरियन सवाल पूछने, कहानियाँ लिखने और पहेलियाँ सुलझाने में अद्भुत है। हालाँकि, इसमें एक पेच है: इस लाइब्रेरियन की याददाश्त प्रणाली बहुत खराब है।

समस्या: "क्वाड्रेटिक" (Quadratic) बाधा

वर्तमान दुनिया में, यदि आप लाइब्रेरियन को 10 पन्नों की एक कहानी याद रखने के लिए कहते हैं, तो उन्हें हर नया वाक्य पढ़ते समय उन सभी 10 पन्नों को फिर से पलटना पड़ता है। यदि कहानी 1,000 पन्नों लंबी है, तो उन्हें हर एक शब्द लिखते समय 1,000 पन्ने पलटने पड़ते हैं।

इसे क्वाड्रेटिक कॉम्प्लेक्सिटी (Quadratic Complexity) कहा जाता है। यह समुद्र तट पर रेत के हर एक कण को दूसरे हर एक कण के साथ मिलाने और जाँचने जैसा है।

  • परिणाम: लाइब्रेरियन थक जाता है (कंप्यूटेशनल लागत), डेस्क की जगह खत्म हो जाती है (मेमोरी), और अंततः जब कहानी बहुत लंबी हो जाती है, तो वह हार मान लेता है। वह "लॉन्ग-कॉन्टेक्स्ट" (लंबी संदर्भ वाली) कार्यों को नहीं संभाल सकता जैसे कि एक पूरा उपन्यास पढ़ना या एक साथ पूरे साल के ईमेल का विश्लेषण करना।

समाधान: "लिज़र्ड" (Lizard) का आगमन

शोधकर्ताओं ने लिज़र्ड (Lizard) नामक एक नया फ्रेमवर्क बनाया है। लिज़र्ड को एक नए लाइब्रेरियन के रूप में नहीं, बल्कि एक जादुई फाइलिंग सिस्टम के रूप में सोचें जिसे मौजूदा बुद्धिमान लाइब्रेरियन के साथ जोड़ा गया है। यह लाइब्रेरियन की अव्यवस्थित, धीमी मेमोरी को एक सुपर-कुशल, संक्षिप्त मेमोरी में बदल देता है जो बिना थके अनंत लंबाई की कहानियों को संभाल सकता है।

यहाँ बताया गया है कि लिज़र्ड कैसे काम करता है, जिसे तीन सरल भागों में बांटा गया है:

1. "स्मार्ट गेट" (अनुकूली मेमोरी - Adaptive Memory)

कल्पना कीजिए कि लाइब्रेरियन के पास एक बाल्टी है जिसमें वे पुरानी यादों को फेंक देते हैं। आमतौर पर, वे चीजों को बेतरतीब ढंग से या एक निश्चित शेड्यूल के आधार पर फेंक देते हैं।

  • लिज़र्ड का नवाचार: लिज़र्ड इस बाल्टी में एक स्मार्ट गेट जोड़ता है। यह गेट एक बाउंसर की तरह है जो तय करता है, "क्या मुझे इस विशिष्ट विवरण को याद रखने की आवश्यकता है?"
  • यदि विवरण महत्वपूर्ण है (जैसे किसी पात्र का नाम), तो गेट उसे रखता है। यदि वह केवल शोर है (जैसे "आसमान नीला था"), तो गेट उसे धुंधला होकर मिट जाने देता है।
  • यह क्यों मायने रखता है: यह लाइब्रेरियन को 1,00,000 पन्नों की किताब के सार को याद रखने की अनुमति देता है बिना शहर के आकार के गोदाम की आवश्यकता के। यह सीखता है कि क्या भूलना है और क्या रखना है, बजाय इसके कि केवल एक कठोर नियम का पालन करे।

2. "एंकर विंडो" (स्थानीय सटीकता - Local Precision)

जबकि "स्मार्ट गेट" बड़ी तस्वीर को याद रखने में बेहतरीन है, कभी-कभी यह सूक्ष्म, तीखे विवरणों (जैसे कोई विशिष्ट संख्या या उद्धरण) को चूक जाता है।

  • लिज़र्ड का नवाचार: लिज़र्ड एक छोटा, हाई-डेफिनिशन मैग्नीफाइंग ग्लास (जिसे एंकर विंडो कहा जाता है) जोड़ता है जो पिछले कुछ वाक्यों को करीब से देखता है।
  • उपमा: इसे ऐसे समझें कि स्मार्ट गेट पूरे जंगल को देखने वाला एक वाइड-एंगल लेंस है, और एंकर विंडो एक विशिष्ट पेड़ को देखने वाला ज़ूम लेंस है। लिज़र्ड दोनों को जोड़ता है: यह अपनी संक्षिप्त मेमोरी में बड़ी तस्वीर को बनाए रखता है और साथ ही बारीक विवरणों को सही करने के लिए ज़ूम लेंस का उपयोग करता है।

3. "हार्डवेयर फिक्स" (इंजन की गति बढ़ाना - Speeding Up the Engine)

शोधकर्ताओं ने देखा कि जब उन्होंने इस "स्मार्ट गेट" को बनाने की कोशिश की, तो गणित जटिल और अस्थिर हो गया, जिससे कंप्यूटर धीमा हो गया और अधिक बिजली खर्च करने लगा।

  • लिज़र्ड का नवाचार: उन्होंने गणित को फिर से लिखा (जैसे केक बनाने की रेसिपी बदलना) ताकि यह आधुनिक कंप्यूटर चिप्स (टेंसर कोर्स) में पूरी तरह फिट हो सके।
  • परिणाम: इसने प्रशिक्षण प्रक्रिया को 32% तेज़ बना दिया। यह एक कार के इंजन को ट्यून करने जैसा है ताकि वह बिना डिज़ाइन बदले, कम ईंधन का उपयोग करके और सुचारू रूप से चल सके।

परिणाम: आपको इसकी परवाह क्यों करनी चाहिए?

लिज़र्ड के परीक्षण के लिए शोधकर्ताओं ने एक शीर्ष-स्तरीय AI मॉडल (जैसे Llama-3 या Mistral) लिया और उसकी धीमी मेमोरी को लिज़र्ड की कुशल प्रणाली से बदल दिया।

  • प्रदर्शन (Performance): नया "लिज़र्ड" मॉडल मूल प्रतिभाशाली लाइब्रेरियन की तरह ही प्रदर्शन करता है। इसने अपनी बुद्धिमत्ता नहीं खोई। वास्तव में, कुछ परीक्षणों में, यह AI को तेज़ बनाने के अन्य प्रयासों से 9 से 24 अंक बेहतर था।
  • मेमोरी (Memory): मूल मॉडल 32,000 शब्दों की कहानी पढ़ने पर क्रैश हो गया था। लिज़र्ड ने इसे कांस्टेंट मेमोरी (Constant Memory) के साथ पढ़ा, जिसका अर्थ है कि कहानी 1 पन्ने की हो या 1,000 पन्नों की, इसने समान मात्रा में कंप्यूटर पावर का उपयोग किया।
  • रिकॉल (Recall): यदि आपने 64,000 शब्दों के दस्तावेज़ में कोई गुप्त कोड छिपाया होता, तो लिज़र्ड उसे पूरी तरह से ढूंढ सकता था। अन्य तरीके दस्तावेज़ के प्रशिक्षित सीमा से लंबा होते ही विफल हो गए।

निचोड़ (The Bottom Line)

लिज़र्ड एक सेतु (Bridge) है। यह आज के शक्तिशाली, महंगे AI मॉडलों को लेती है और उन्हें एक "सुपरपावर" देती है जिससे वे बिना धीमे हुए या मेमोरी खत्म हुए अनंत मात्रा में टेक्स्ट पढ़ सकें।

यह एक फेरारी (वर्तमान AI) को एक हाइब्रिड इंजन (लिज़र्ड) देने जैसा है जो इसे बिना ईंधन के लिए रुके, हमेशा के लिए चलाने की अनुमति देता है, जबकि यह पहले की तरह ही तेज़ और स्मार्ट रहता है। यह उन्नत AI को छोटे उपकरणों पर चलाने या ऐसे कार्यों के लिए उपयोग करने को संभव बनाता है जिनमें सेकंडों में पूरी किताबें, कानूनी अनुबंध, या वर्षों के डेटा को पढ़ना आवश्यक हो।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →