← नवीनतम पेपर
🤖 machine learning

NeST: Neighborhood-aware semantic alignment and temporal modulation for LLM based time series forecasting

यह शोधपत्र NeST का प्रस्ताव करता है, जो एक नवीन ढांचा है जो पड़ोस-जागरूक (neighborhood-aware) टेक्स्ट प्रोटोटाइप उत्पन्न करके, उन्हें कंट्रास्टिव लर्निंग के माध्यम से टेम्पोरल रिप्रेजेंटेशन्स के साथ संरेखित करके, और विविध बेंचमार्क एवं वास्तविक दुनिया के कार्यों में बेहतर प्रदर्शन और सामान्यीकरण प्राप्त करने के लिए प्रोटोटाइप-कंडीशन्ड टेम्पोरल मॉड्यूलेशन लागू करके LLM-आधारित टाइम सीरीज़ फोरकास्टिंग को उन्नत करता है।

मूल लेखक: Jayanie Bogahawatte, Sachith Seneviratne, Maneesha Perera, Saman Halgamuge

प्रकाशित 2026-08-25
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Jayanie Bogahawatte, Sachith Seneviratne, Maneesha Perera, Saman Halgamuge

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

समय के साथ बदलने वाली संख्याओं के भविष्य की भविष्यवाणी करना एक ऐसा कार्य है जो यह तय करता है कि हम अपने शहरों को कैसे ऊर्जावान बनाएँ, अपनी वित्त व्यवस्था को कैसे प्रबंधित करें और मौसम के लिए कैसे तैयार हों। दशकों से, वैज्ञानिक इन पैटर्न का पूर्वानुमान लगाने के लिए विशेष गणितीय उपकरणों पर भरोसा करते आए हैं, जिन्हें 'टाइम सीरीज़' (time series) कहा जाता है। ये उपकरण तब अच्छा काम करते हैं जब डेटा अनुमानित तरीकों से व्यवहार करता है, लेकिन जब पैटर्न जटिल, अव्यवस्थित या जब सीखने के लिए बहुत कम डेटा उपलब्ध हो, तो वे अक्सर संघर्ष करते हैं। हाल के वर्षों में, 'लार्ज लैंग्वेज मॉडल' (Large Language Model) नामक एक नया प्रकार का आर्टिफिशियल इंटेलिजेंस उभरा है। मूल रूप से मानवीय भाषा को समझने के लिए प्रशिक्षित, ये मॉडल शब्दों के अनुक्रमों (sequences) में पैटर्न पहचानने में अविश्वसनीय रूप से कुशल हैं। चूँकि टाइम सीरीज़ डेटा भी एक अनुक्रम है, इसलिए शोधकर्ताओं ने इन लैंग्वेज मॉडल्स को वाक्यों के बजाय संख्याओं को समझने के लिए प्रशिक्षित करने की कोशिश शुरू कर दी है। चुनौती लैंग्वेज मॉडल द्वारा जाने जाने वाले विविक्त (discrete) और अलग-अलग शब्दों और वास्तविक दुनिया के डेटा, जैसे बिजली के उपयोग या तापमान के सुचारू और निरंतर प्रवाह के बीच के अंतर को पाटने में निहित है।

मेलबर्न विश्वविद्यालय के शोधकर्ताओं की एक टीम ने इस समस्या को हल करने के लिए एक नई विधि विकसित की है, जिसे उन्होंने 'नेस्ट' (NeST) नाम दिया है। उनका दृष्टिकोण इस बात पर केंद्रित है कि लैंग्वेज मॉडल की शब्दों की समझ को समय को समझने के लिए एक मार्गदर्शक में सबसे अच्छी तरह से कैसे बदला जाए। मॉडल को केवल संख्याओं की सूची को शब्दों की तरह पढ़ने के लिए मजबूर करने के बजाय, या भारी-भरकम तकनीकों का उपयोग करने के बजाय जिनमें अत्यधिक कंप्यूटिंग शक्ति की आवश्यकता होती है, नेस्ट "टेक्स्ट प्रोटोटाइप" (text prototypes) का एक सेट बनाता है। इन प्रोटोटाइप्स को सावधानीपूर्वक चुने गए प्रतिनिधि एंकरों (anchors) के रूप में सोचें जो लैंग्वेज मॉडल की विशाल शब्दावली के भीतर अर्थ के स्थानीय क्षेत्रों को पकड़ते हैं। शोधकर्ताओं ने सिस्टम को यह सुनिश्चित करने के लिए प्रशिक्षित किया कि ये एंकर लैंग्वेज मॉडल के ज्ञान की मूल संरचना के प्रति सच्चे रहें, न कि उन क्षेत्रों में भटक जाएँ जहाँ मॉडल की कोई वास्तविक समझ न हो।

एक बार जब ये टेक्स्ट एंकर स्थापित हो जाते हैं, तो सिस्टम उन्हें उस वास्तविक टाइम सीरीज़ डेटा के साथ संरेखित करता है जिसकी उसे भविष्यवाणी करनी होती है। यह डेटा और टेक्स्ट एंकरों के बीच निकटतम मिलान खोजकर ऐसा करता है, जिससे यह सुनिश्चित होता है कि लैंग्वेज मॉडल का अर्थ संबंधी ज्ञान (semantic knowledge) संख्याओं के विशिष्ट पैटर्न के लिए सीधे तौर पर प्रासंगिक हो। महत्वपूर्ण रूप से, टेक्स्ट और नंबरों को इस तरह से मिलाने के बजाय जिससे मॉडल का आंतरिक समय भ्रमित हो सकता है, नेस्ट इन टेक्स्ट एंकरों का उपयोग डेटा को धीरे से समायोजित करने के लिए करता है। यह संख्यात्मक विशेषताओं को स्केल और शिफ्ट करता है, जिससे लैंग्वेज मॉडल को टाइम सीरीज़ की प्राकृतिक लय को बाधित किए बिना अपने सीखे हुए ज्ञान को लागू करने की अनुमति मिलती है। यह प्रक्रिया कुशल है, जिसमें मॉडल की सेटिंग्स के केवल एक छोटे से अंश में परिवर्तन की आवश्यकता होती है जबकि शेष विशाल ज्ञान बरकरार रहता है।

इस नए दृष्टिकोण के परिणाम विविध प्रकार के परीक्षणों में मजबूत और सुसंगत हैं। दीर्घकालिक पूर्वानुमान के लिए मानक बेंचमार्क पर परीक्षण करते समय, जैसे कि बिजली की मांग या यातायात प्रवाह की भविष्यवाणी करना, नेस्ट ने वर्तमान सर्वोत्तम विधियों को पछाड़ दिया और औसत रूप से 1.2 प्रतिशत तक भविष्यवाणी त्रुटियों को कम किया। यह एक छोटी संख्या लग सकती है, लेकिन पूर्वानुमान की दुनिया में, मामूली सुधार भी महत्वपूर्ण बचत और बेहतर निर्णय लेने की ओर ले जा सकते हैं। यह पद्धति तब भी उल्लेखनीय रूप से प्रभावी सिद्ध हुई जब डेटा दुर्लभ था। उन स्थितियों में जहाँ मॉडल को उपलब्ध डेटा के बहुत छोटे हिस्से से सीखना था, या जब इसे किसी नए प्रकार के डेटा की भविष्यवाणी करनी थी जिसे उसने पहले कभी नहीं देखा था, नेस्ट ने अन्य दृष्टिकोणों की तुलना में लगभग 5 प्रतिशत तक त्रुटियों को कम करते हुए उच्च सटीकता बनाए रखी।

मानक परीक्षणों से परे, शोधकर्ताओं ने नेस्ट को एक वास्तविक दुनिया की चुनौती पर लागू किया: वितरित सौर पैनलों (distributed solar panels) के बिजली उत्पादन का पूर्वानुमान लगाना। सौर ऊर्जा उत्पादन की भविष्यवाणी करना कठिन है क्योंकि यह उतार-चढ़ाव वाले मौसम की स्थिति पर निर्भर करता है और विभिन्न स्थानों पर भिन्न होता है। इस सिस्टम का परीक्षण विविध भौगोलिक क्षेत्रों में सौर स्टेशनों के नौ अलग-अलग डेटासेट्स पर किया गया। हर मामले में, नेस्ट ने समग्र रूप से सर्वश्रेष्ठ प्रदर्शन किया, जिससे मौजूदा विधियों की तुलना में भविष्यवाणियों की सटीकता में औसतन 3.3 प्रतिशत का सुधार हुआ, जो विशेष रूप से सौर ऊर्जा के लिए डिज़ाइन की गई हैं। यह सुझाव देता है कि यह फ्रेमवर्क केवल एक सैद्धांतिक सुधार नहीं है बल्कि एक व्यावहारिक उपकरण है जो वास्तविक दुनिया की ऊर्जा प्रणालियों की जटिल और परिवर्तनशील प्रकृति को संभालने में सक्षम है।

नेस्ट की सफलता भाषा और समय दोनों की अनूठी प्रकृति का सम्मान करने की इसकी क्षमता में निहित है। लैंग्वेज मॉडल की शब्दावली के भीतर ज्यामितीय संबंधों को संरक्षित करके और एक कठोर संबंध बनाने के बजाय संख्यात्मक डेटा को निर्देशित करने के लिए उनका उपयोग करके, शोधकर्ताओं ने एक ऐसा सिस्टम बनाया है जो लचीला और सटीक दोनों है। उनके कार्य के विज़ुअलाइज़ेशन दिखाते हैं कि उनकी विधि टेक्स्ट एंकरों को लैंग्वेज मॉडल के ज्ञान के सघन और अर्थपूर्ण क्षेत्रों में मजबूती से बनाए रखती है, जबकि पिछली विधियों के विपरीत, जो इन एंकरों को खाली या अप्रासंगिक स्थानों में भटकने देती थीं। यह सावधानीपूर्वक संरेखण मॉडल को डेटा के शोरपूर्ण या अधूरा होने पर भी बेहतर भविष्यवाणियां करने के लिए अपने गहरे पैटर्न संबंधी ज्ञान का लाभ उठाने की अनुमति देता है।

अंततः, यह कार्य प्रदर्शित करता है कि बड़े लैंग्वेज मॉडल्स को उनके मुख्य गुणों को खोए बिना टाइम सीरीज़ पूर्वानुमान के लिए प्रभावी ढंग से अनुकूलित किया जा सकता है। नेस्ट फ्रेमवर्क टेक्स्ट ज्ञान को संख्यात्मक भविष्यवाणी में एकीकृत करने का एक तरीका प्रदान करता है जो कंप्यूटिंग के मामले में कुशल और अत्यधिक सटीक है। जैसे-जैसे दुनिया अधिक डेटा उत्पन्न कर रही है और जटिल पूर्वानुमान चुनौतियों का सामना कर रही है, इस तरह के तरीके एक विश्वसनीय मार्ग प्रदान करते हैं, जो यह सिद्ध करते हैं कि भाषा को समझने के लिए उपयोग किए जाने वाले उपकरण हमें भौतिक दुनिया की लय को समझने में भी मदद कर सकते हैं। निष्कर्ष बताते हैं कि सही दृष्टिकोण के साथ, टेक्स्ट और समय के बीच के अंतर को पाटा जा सकता है, जिससे ऊर्जा प्रबंधन से लेकर आर्थिक नियोजन जैसे क्षेत्रों में अधिक सटीक भविष्यवाणियों की ओर ले जाने वाला मार्ग प्रशस्त होता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →