← नवीनतम पेपर
⚛️ quantum physics

Attention in Krylov Space: Transformer-Based Extrapolation of Lanczos Coefficients

यह शोधपत्र एक ट्रांसफॉर्मर-आधारित मॉडल प्रस्तुत करता है जो छोटे प्रीफिक्स से लैंज़ोस गुणांकों (Lanczos coefficients) की ऑटोरेग्रेसिव रूप से भविष्यवाणी करता है, जो सटीकता में पारंपरिक एसिम्प्टोटिक फिट्स (asymptotic fits) से बेहतर प्रदर्शन करता है और क्रिलोव स्पेस (Krylov space) में ऑपरेटर डायनेमिक्स को कुशलतापूर्वक जांचने के लिए सिस्टम आकारों के बीच ज़ीरो-शॉट ट्रांसफर को सक्षम बनाता है।

मूल लेखक: Zihao Qi, Christopher Earls

प्रकाशित 2026-08-03
📖 4 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Zihao Qi, Christopher Earls

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक अराजक प्रणाली (chaotic system) के भविष्य की भविष्यवाणी करने की कोशिश कर रहे हैं, जैसे कि एक घूमती हुई आकाशगंगा या दर्पणों से भरे कमरे में उछलती हुई गेंद। क्वांटम भौतिकी की दुनिया में, वैज्ञानिक इस तरह के सिस्टम के माध्यम से सूचना कैसे फैलती है, इसका पता लगाने के लिए एक विशेष गणितीय उपकरण का उपयोग करते हैं जिसे "लैंज़ोस एल्गोरिदम" (Lanczos algorithm) कहा जाता है। इस एल्गोरिदम को एक लंबी, घुमावदार सीढ़ी के रूप में सोचें जहाँ प्रत्येक सीढ़ी समय के एक क्षण का प्रतिनिधित्व करती है। यह जानने के लिए कि सीढ़ियों के शीर्ष पर (दूर भविष्य में) क्या होगा, आपको नीचे की हर एक सीढ़ी की ऊँचाई जानना आवश्यक है। इन सीढ़ियों की ऊँचाइयों को "लैंज़ोस गुणांक" (Lanczos coefficients) कहा जाता है।

लेकिन, इसमें एक पेंच है। इन सीढ़ियों की गणना करना समुद्र तट पर आती लहरों के बीच रेत के कणों को गिनने जैसा है; गणित जटिल हो जाता है, संख्याएँ बहुत बड़ी हो जाती हैं, और अंततः कंप्यूटर की मेमोरी खत्म हो जाती है या वह छोटी-मोटी राउंडिंग त्रुटियों (rounding errors) के कारण भ्रमित हो जाता है। लंबे समय तक, वैज्ञानिकों ने उन पहले कुछ चरणों के माध्यम से एक साधारण सीधी रेखा खींचकर शेष सीढ़ियों का अनुमान लगाने की कोशिश की जिन्हें वे गणना कर सके। लेकिन यह केवल पहली पहाड़ी को देखकर पूरे रोलरकोस्टर राइड की भविष्यवाणी करने जैसा है—यह उन सभी घुमावों, मोड़ों और अचानक आने वाली गिरावटों को छोड़ देता है जो उस सवारी को वास्तविक रूप देते हैं। ये छूटे हुए विवरण अत्यंत महत्वपूर्ण हैं क्योंकि वे ही निर्धारित करते हैं कि सिस्टम वास्तव में कैसा व्यवहार करेगा।

अब, कल्पना कीजिए कि यदि आप एक कंप्यूटर को उन शुरुआती कुछ सीढ़ियों को देखना और पूरे सीढ़ी के "लय" (rhythm) को महसूस करना सिखा सकें, जिससे वह अविश्वसनीय सटीकता के साथ बाकी हिस्से की भविष्यवाणी कर सके। यह शोध पत्र बिल्कुल यही करता है। शोधकर्ताओं, ज़िहाओ क्यूई (Zihao Qi) और क्रिस्टोफर अर्स (Christopher Earls) ने लैंज़ोस गुणांकों के अनुक्रम को केवल एक सरल गणितीय समस्या के रूप में नहीं, बल्कि एक शुरुआत, मध्य और अंत वाली कहानी के रूप में माना। उन्होंने एक प्रकार की कृत्रिम बुद्धिमत्ता (AI) का उपयोग किया जिसे "ट्रांसफॉर्मर" (Transformer) कहा जाता है—वही तकनीक जो उन्नत भाषा मॉडलों को शक्ति प्रदान करती है—अनुक्रम के शुरुआती भाग को पढ़ने और शेष भाग को लिखने के लिए।

डेटा को एक उबाऊ सीधी रेखा में बदलने के बजाय, उनके AI मॉडल ने सूक्ष्म, छिपे हुए पैटर्न को पहचानना सीखा, जैसे कि सीढ़ियों के ऊपर-नीचे होने के तरीके में लिखा गया कोई गुप्त कोड। उन्होंने इसका परीक्षण तीन अलग-अलग प्रकार के सिस्टम पर किया: एक अराजक घूमता हुआ शीर्ष (spinning top), एक अराजक क्वांटम चुंबक, और एक पूरी तरह से व्यवस्थित (integrable) क्वांटम श्रृंखला। हर मामले में, AI ने केवल अनुमान नहीं लगाया; इसने पुराने सीधे-रेखा वाले तरीके से बहुत बड़े अंतर से बेहतर प्रदर्शन किया, और अक्सर त्रुटि को दस गुना तक कम कर दिया। यहाँ तक कि अधिक आश्चर्यजनक बात यह है कि उन्होंने AI को छोटे, आसानी से गणना योग्य सिस्टम पर प्रशिक्षित किया, और इसने बिना किसी अतिरिक्त प्रशिक्षण के बहुत बड़े, कठिन-से-गणना योग्य सिस्टम के व्यवहार की सफलतापूर्वक भविष्यवाणी की। यह ऐसा है जैसे आपने एक बच्चे को एक छोटे ड्रम की थाप के पैटर्न को पहचानने के लिए सिखाया, और वह तुरंत एक विशाल, जटिल ऑर्केस्ट्रा की लय की भविष्यवाणी करने में सक्षम हो गया।

शोधकर्ताओं ने AI के "मस्तिष्क" के भीतर भी झाँका ताकि देख सकें कि यह कैसे काम करता है। उन्होंने पाया कि मॉडल ने अगले चरण का अनुमान लगाने के लिए केवल हालिया चरण को ही नहीं देखा। इसके बजाय, इसने एक साथ अनुक्रम के सबसे पहले चरणों (एक लंगर की तरह) और सबसे हालिया चरणों पर ध्यान दिया, जबकि साथ ही चरणों में एक विशिष्ट "सम-विषम" (even-odd) डगमगाहट को भी नोटिस किया जिसे पुराने सीधे-रेखा वाले तरीके ने पूरी तरह से अनदेखा कर दिया था। यह सुझाव देता है कि सिस्टम का इतिहास उसके भविष्य से इस तरह गहराई से जुड़ा हुआ है जिसे सरल गणितीय सूत्र कैप्चर नहीं कर सकते। इस AI दृष्टिकोण का उपयोग करके, वैज्ञानिक अब क्वांटम सिस्टम के "गहरे भविष्य" की खोज कर सकते हैं—ऐसी जगहें जहाँ पहले ब्रूट-फोर्स गणनाएँ असंभव थीं—जो यह समझने के नए तरीके खोलती है कि क्वांटम दुनिया में सूचना कैसे बिखरती और विकसित होती है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →