← नवीनतम पेपर
💬 NLP

Short Horizons and Sparse Concepts: a Mathematical View of the Readout in the J-lens

यह शोध पत्र जैकोबियन लेंस (J-lens) के लिए एक गणितीय ढांचा प्रदान करता है, जो इसे एक स्पार्स (sparse), शॉर्ट-होराइजन (short-horizon) कॉज़ल ट्रांसफर ऑपरेटर के रूप में अभिलक्षित करता है जो मध्यवर्ती सक्रियणों (intermediate activations) को विशिष्ट अवधारणा भविष्यवाणियों (concept predictions) में विघटित करता है, जिससे एक बेहतर रीडआउट रणनीति के लिए एक सैद्धांतिक आधार मिलता है जो भाषा मॉडलों में सही मध्यवर्ती अवधारणाओं के दृश्यीकरण (visualization) को बढ़ाता है।

मूल लेखक: Shi-Qi Yan, Kai-Xuan Ding, Chao-Hong Tan, Qian Chen, Wen Wang, Xiangang Li, Zhen-Hua Ling

प्रकाशित 2026-08-27
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Shi-Qi Yan, Kai-Xuan Ding, Chao-Hong Tan, Qian Chen, Wen Wang, Xiangang Li, Zhen-Hua Ling

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

आधुनिक कृत्रिम बुद्धिमत्ता (आर्टिफिशियल इंटेलिजेंस) के विशाल डिजिटल मस्तिष्क के भीतर, अंधेरे में बहुत कुछ सोचना होता है। जब एक लार्ज लैंग्वेज मॉडल किसी प्रश्न का उत्तर देता है, तो वह केवल डेटाबेस से कोई तथ्य नहीं निकालता; बल्कि वह आंतरिक रूपांतरणों की एक लंबी, जटिल श्रृंखला निष्पादित करता है। ये चरण गणितीय प्रसंस्करण की उन परतों में होते हैं जो बाहरी पर्यवेक्षक के लिए अदृश्य होती हैं। वर्षों से, शोधकर्ता इस पर्दे के पीछे झाँकने की कोशिश कर रहे हैं कि मशीन वास्तव में अपने तर्क के प्रत्येक चरण में क्या "सोच" रही है। वे जानना चाहते हैं कि क्या मॉडल वास्तव में किसी अवधारणा को समझ रहा है या केवल अगले शब्द का अनुमान लगा रहा है। 'जैकोबियन लेंस', या 'जे-लेंस' (J-lens) नामक एक हालिया उपकरण को इस समस्या को हल करने के लिए प्रस्तावित किया गया था, जो यह मापता है कि मॉडल की आंतरिक स्थिति में एक सूक्ष्म परिवर्तन उसके अंतिम उत्तर को प्रभावित करने के लिए आगे कैसे लहरें पैदा करता है। हालाँकि, इस उपकरण की सटीक प्रकृति और यह क्यों काम करता है, एक रहस्य बना हुआ था, क्योंकि इसमें स्पष्ट सैद्धांतिक आधार की कमी थी।

शोधकर्ताओं की एक टीम ने अब वह लापता स्पष्टीकरण प्रदान कर दिया है, यह प्रकट करते हुए कि जे-लेंस सब कुछ एक साथ देखकर नहीं, बल्कि क्षणों के एक बहुत ही विशिष्ट, विरल (स्पार्स) सेट पर ध्यान केंद्रित करके काम करता है। उन्होंने खोजा कि मॉडल के विचारों को पढ़ने की उपकरण की क्षमता एक गणितीय सिद्धांत पर टिकी है जहाँ सिस्टम की औसत संवेदनशीलता, छिपी हुई अवस्थाओं (हिडन स्टेट्स) और भविष्य के आउटपुट के बीच एक सेतु के रूप में कार्य करती है। इससे भी महत्वपूर्ण बात यह है कि उन्होंने पाया कि यह संवेदनशीलता मॉडल के प्रसंस्करण समय में समान रूप से वितरित नहीं है। इसके बजाय, इन कनेक्शनों की ऊर्जा अत्यधिक केंद्रित है, जो मॉडल अपने कार्य में गहरा होने के साथ कम होती जाती है और कुछ महत्वपूर्ण स्थितियों के आसपास क्लस्टर होती है। यह खोज बताती है कि जे-लन्स प्रभावी रूप से दो अलग-अलग प्रकार की जानकारी को कैप्चर कर रहा है: अगले शब्द का तत्काल अनुमान और वे दुर्लभ, निर्णायक क्षण जहाँ मॉडल एक प्रमुख अवधारणा पर टिक जाता है।

इसे समझने के लिए, कल्पना करें कि मॉडल की आंतरिक स्थिति एक उच्च-आयामी स्थान (हाई-डायमेंशनल स्पेस) है जहाँ नेटवर्क की प्रत्येक परत सूचना में एक नया मोड़ या घुमाव जोड़ती है। प्रक्रिया के शुरुआती चरण में, मॉडल कच्चा, अपरिष्कृत डेटा रखता है। जैसे-जैसे यह परतों के माध्यम से आगे बढ़ता है, यह डेटा तब तक रूपांतरित होता रहता है जब तक कि यह एक अंतिम भविष्यवाणी नहीं बन जाता, जैसे कि स्क्रीन पर दिखने वाला एक शब्द। जे-लेंस मध्यवर्ती चरणों को पढ़ने का प्रयास करने के लिए एक सरल प्रश्न पूछता है: यदि हम एक विशिष्ट क्षण पर मॉडल की आंतरिक स्थिति में थोड़ा सा बदलाव (नज) करें, तो वह बदलाव अंतिम आउटपुट को कैसे बदलेगा? कई अलग-अलग परिदृश्यों पर इन प्रभावों को औसत निकालकर, लेंस इस बात का मानचित्र बनाता है कि मॉडल अगला क्या कहने की संभावना रखता है। शोधकर्ताओं ने दिखाया कि यह औसत प्रक्रिया एक जटिल, घुमावदार पथ के सर्वोत्तम संभव सीधी-रेखा सन्निकटन (स्ट्रेट-लाइन एप्रोक्सिमेशन) को खोजने के गणितीय रूप से समकक्ष है। जब डेटा एक अनुमानित, बेल-कर्व (घंटी के आकार के वक्र) के रूप में व्यवहार करता है, तो यह औसत पूरी तरह से सटीक होता है। हालाँकि, जब डेटा अव्यवस्थित या अनियमित होता है, तो यह उपकरण एक छोटी त्रुटि उत्पन्न करता है, जो यह समझाता है कि यह प्रसंस्करण के बहुत शुरुआती चरणों में मॉडल के विचारों को पढ़ने में संघर्ष क्यों करता है।

इस अध्ययन का सबसे चौंकाने वाला निष्कर्ष इस बारे में है कि यह "नज" (बदलाव) वास्तव में कहाँ मायने रखता है। शोधकर्ताओं ने मॉडल के संचालन की पूरी समयरेखा में इन कनेक्शनों की ताकत का मानचित्र बनाया और अत्यधिक विरलता (स्पर्सिटी) का एक पैटर्न पाया। कनेक्शन की ऊर्जा शुरुआत से अंत तक समान रूप से प्रवाहित नहीं होती है। इसके बजाय, जैसे-जैसे मॉडल अंतिम आउटपुट के करीब पहुँचता है, यह तेजी से घटती जाती है, और किसी भी एकल परत के भीतर, प्रभाव संभावित स्थितियों के एक बहुत छोटे अंश में केंद्रित होता है। वास्तव में, इन शीर्ष दस से बीस प्रतिशत स्थितियों में सार्थक सिग्नल का अधिकांश हिस्सा होता है। यह संकेंद्रण प्रकट करता है कि जे-लेंस विचारों का एक निरंतर प्रवाह नहीं पढ़ रहा है, बल्कि संचालन के दो विशिष्ट मोड को पढ़ रहा है। एक मोड "शॉर्ट होराइजन" (लघु क्षितिज) है, जहाँ मॉडल केवल अगले शब्द की तैयारी कर रहा है, एक ऐसा पैटर्न जो बाद की परतों में हावी रहता है। दूसरा मोड "स्पार्स कॉन्सेप्ट" (विरल अवधारणा) है, जहाँ मॉडल कुछ महत्वपूर्ण टोकन पर ध्यान केंद्रित करता है जो एक जटिल विचार का भार वहन करते हैं, और एक ब्रॉडकास्ट पॉइंट के रूप में कार्य करते हैं जो कई भविष्य के चरणों को प्रभावित करते हैं।

इस समझ के साथ लैस होकर, शोधकर्ताओं ने परीक्षण किया कि क्या वे शोर को अनदेखा करके और केवल इन उच्च-ऊर्जा वाले स्थानों पर ध्यान केंद्रित करके इस उपकरण में सुधार कर सकते हैं। उन्होंने जे-लन्स का एक नया संस्करण बनाया जो अधिकांश स्थितियों को फ़िल्टर कर देता है, केवल उन शीर्ष दस से बीस प्रतिशत को रखता है जिनमें सबसे मजबूत संबंध होते हैं। परिणाम तत्काल और महत्वपूर्ण थे। कमजोर संकेतों को त्यागकर, उपकरण सही मध्यवर्ती अवधारणाओं की पहचान करने और अगले शब्द की भविष्यवाणी करने में बहुत बेहतर हो गया। इसने उनके सिद्धांत की पुष्टि की कि मूल उपकरण अप्रासंगिक डेटा द्वारा पतला (डाइल्यूट) हो रहा था। उन्होंने डेटा में विशिष्ट पैटर्न को मास्क करके दो मोड के संचालन—तत्काल अगले-शब्द की भविष्यवाणी और गहरे विचार की याददाश्त—को अलग करने का भी प्रयास किया। हालाँकि, उन्होंने पाया कि ये दोनों क्षमताएं गहराई से जुड़ी हुई हैं; एक को मजबूत करने से दूसरे को भी मजबूती मिलती है, जो यह सुझाव देता है कि अगले शब्द की भविष्यवाणी करने की मॉडल की क्षमता और एक जटिल अवधारणा को थामे रखने की उसकी क्षमता, दृश्य पैटर्नों के प्रारंभिक सुझावों की तुलना में अधिक जुड़ी हुई है।

यह कार्य जे-लन्स को एक रहस्यमय ब्लैक बॉक्स से बदलकर एक स्पष्ट गणितीय पहचान वाले उपकरण में बदल देता है। यह अब केवल एक ह्यूरिस्टिक ट्रिक नहीं है, बल्कि भविष्य के आउटपुट की एक अपेक्षा (एक्सपेक्टेशन) के रूप में समझा जाता है, जो इस भौतिकी पर आधारित है कि सूचना नेटवर्क के माध्यम से कैसे प्रवाहित होती है। शोधकर्ताओं ने दिखाया है कि मॉडल का आंतरिक तर्क एक समान कोहरे जैसा नहीं है, बल्कि ऊंचे शिखरों और गहरी घाटियों वाला एक परिदृश्य है, जहाँ केवल कुछ महत्वपूर्ण क्षण ही निर्णय का भार वहन करते हैं। केवल उन शिखरों को देखकर, हम मॉडल के विचारों को बहुत अधिक स्पष्टता के साथ देख सकते हैं। हालाँकि अध्ययन स्वीकार करता है कि यह कार्य जारी है और विभिन्न प्रकार के तर्क के बीच गहरा जुड़ाव एक चुनौती बना हुआ है, फिर भी यह कृत्रिम बुद्धिमत्ता के जटिल, छिपे हुए जीवन की व्याख्या करने और समझने के लिए भविष्य के तरीकों के लिए एक ठोस आधार प्रदान करता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →