← नवीनतम पेपर
🤖 machine learning

ConceptTS: LLM-Guided Concept Bottlenecks for Interpretable Multivariate Time-Series Forecasting

ConceptTS एक व्याख्यात्मक मल्टीवेरिएट टाइम-सीरीज फोरकास्टिंग फ्रेमवर्क है जो तीन पूरक बॉटलनैक्स में व्यवस्थित नामी, मानव-पठनीय अवधारणाओं को स्वचालित रूप से उत्पन्न करने और पर्यवेक्षण करने के लिए लार्ज लैंग्वेज मॉडल्स का लाभ उठाता है, जिससे प्रतिस्पर्धी सटीकता प्राप्त करने के साथ-साथ पारदर्शी, हस्तक्षेप-योग्य भविष्यवाणियां प्रदान की जाती हैं।

मूल लेखक: Yichen Jiang, Yueqiao Chen, Dongyu Liu

प्रकाशित 2026-08-24
📖 7 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Yichen Jiang, Yueqiao Chen, Dongyu Liu

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

डेटा साइंस की दुनिया में, मशीनें भविष्य का अनुमान लगाने के लिए अतीत को देखने में उल्लेखनीय रूप से कुशल हो गई हैं। जब एक कंप्यूटर संख्याओं के प्रवाह को देखता है—जैसे कि वायु प्रदूषण के बदलते स्तर, बिजली की कीमतों में उतार-चढ़ाव, या किसी मरीज के हृदय गति में बदलाव—तो वह अक्सर आश्चर्यजनक सटीकता के साथ यह अनुमान लगा सकता है कि आगे क्या होने वाला है। ये प्रणालियाँ इसलिए शक्तिशाली हैं क्योंकि वे उन जटिल पैटर्न को पहचान सकती हैं जिन्हें मनुष्य शायद चूक सकते हैं, और समय के साथ बदलने वाले दर्जनों अलग-अलग चरों (variables) को एक साथ जोड़ सकती हैं। हालाँकि, इसमें एक बड़ी समस्या है: ये शक्तिशाली मशीनें अक्सर अपारदर्शी होती हैं। वे एक भविष्यवाणी तो करती हैं, लेकिन यह नहीं बतातीं कि क्यों। यह एक मौसम विज्ञानी से तूफान की चेतावनी माँगने जैसा है, और वे केवल एक संख्या की ओर इशारा करते हैं बिना यह बताए कि खतरा उच्च हवाओं से है, भारी बारिश से है, या दबाव में अचानक गिरावट से है। उच्च-दांव वाली स्थितियों में, जैसे कि किसी शहर की वायु गुणवत्ता का प्रबंधन करना या किसी मरीज के स्वास्थ्य की निगरानी करना, यह जानना उतना ही महत्वपूर्ण है जितना कि यह जानना कि "क्या" होने वाला है। चिकित्सकों को पूर्वानुमान के पीछे के तर्क को समझने की आवश्यकता होती है ताकि वे उस पर भरोसा कर सकें, संभावित त्रुटियों को पहचान सकें, और यह जान सकें कि यदि चीजें गलत हो जाती हैं तो हस्तक्षेप कैसे किया जाए।

यही वह चुनौती है जिसे 'ConceptTS' नामक एक नया दृष्टिकोण हल करने का प्रयास करता है। शोधकर्ताओं ने एक ऐसी प्रणाली विकसित की है जो मशीन लर्निंग मॉडल को केवल अमूर्त संख्याओं के बजाय मानव-पठनीय विचारों में सोचने के लिए मजबूर करती है। डेटा को एक "ब्लैक बॉक्स" की तरह काम करने देने के बजाय, यह नया ढांचा मॉडल से उन विशिष्ट, नामित अवधारणाओं (concepts) की पहचान करने को कहता है जो डेटा में क्या हो रहा है उसका वर्णन करते हैं। उदाहरण के लिए, केवल संख्याओं की गणना करने के बजाय, मॉडल यह पहचान सकता है कि हवा की गति बढ़ रही है, तापमान गिर रहा है, या कोई विशिष्ट प्रदूषक इस तरह से व्यवहार कर रहा है जो आमतौर पर प्रदूषण में उछाल आने से पहले होता है। इसे संभव बनाने के लिए, जिसमें डेटा के हर एक क्षण को मैन्युअल रूप से लेबल करने की आवश्यकता न हो, शोधकर्ताओं ने एक लार्ज लैंग्वेज मॉडल (LLM)—जो विशाल मात्रा में टेक्स्ट पर प्रशिक्षित एक उन्नत प्रकार का आर्टिफिशियल इंटेलिजेंस है—का उपयोग एक मार्गदर्शक के रूप में किया है। यह भाषा मॉडल डेटा के इतिहास को पढ़ता है और प्रासंगिक अवधारणाओं का सुझाव देता है, फिर नियमों का एक सेट लिखता है जिसका पालन पूर्वानुमान प्रणाली उन अवधारणाओं की जांच करने के लिए कर सकती है कि वे मौजूद हैं या नहीं।

यह प्रणाली इन विचारों को एक पूर्ण चित्र बनाने के लिए तीन अलग-अलग परतों में व्यवस्थित करती है। सबसे पहले, यह संदर्भ को समझने के लिए हाल के अतीत को देखती है, जैसे कि पूछना: "इस क्षण से कुछ घंटों पहले हवा सामान्य रूप से गर्म थी या ठंडी?" दूसरा, यह भविष्य के पूर्वानुमान को छोटे टुकड़ों में तोड़ती है, स्थानीय विवरणों की जाँच करती है जैसे कि, "क्या इस विशिष्ट घंटे में हवा की गति बढ़ रही है?" अंत में, यह बड़े पैमाने के रुझानों को पहचानने के लिए पूरे पूर्वानुमान अवधि को देखती है, जैसे कि, "क्या आने वाले पूरे दिन में अत्यधिक तापमान परिवर्तन होने की संभावना है?" मॉडल को अंतिम भविष्यवाणी करने से पहले इन विशिष्ट अवधारणाओं के सक्रिय होने की भविष्यवाणी करने के लिए मजबूर करके, शोधकर्ता एक पारदर्शी मार्ग बनाते हैं। मॉडल को पहले यह तय करना होगा कि कौन सी अवधारणाएं सक्रिय हैं, और फिर वह उन निर्णयों का उपयोग पूर्वानुमान उत्पन्न करने के लिए करेगा। इसका अर्थ यह है कि यदि मॉडल प्रदूषण में उछाल की भविष्यवाणी करता है, तो एक इंसान उन अवधारणाओं को देख सकता है और समझ सकता है कि मॉडल कम हवा की गति और उच्च आर्द्रता के संयोजन पर प्रतिक्रिया कर रहा था, न कि अंधेरे में अनुमान लगा रहा था।

इस विचार का परीक्षण करने के लिए, शोधकर्ताओं ने बीजिंग के वास्तविक डेटा का उपयोग करते हुए अपने सिस्टम को लागू किया, जिसमें कई वर्षों के तीन निगरानी केंद्रों से वायु गुणवत्ता माप का उपयोग किया गया। उन्होंने PM2.5 की सांद्रता की भविष्यवाणी करने पर ध्यान केंद्रित किया, जो एक सूक्ष्म कण प्रदूषक है और गंभीर स्वास्थ्य जोखिम पैदा करता है। परिणामों ने दिखाया कि यह प्रणाली वर्तमान में उपलब्ध सबसे उन्नत, अपारदर्शी मॉडलों के समान ही सटीक रूप से भविष्य की वायु गुणवत्ता की भविष्यवाणी कर सकती है। वास्तव में, एक परीक्षण स्थल पर, नई प्रणाली ने औसतन केवल 12.71 माइक्रोग्राम प्रति घन मीटर की त्रुटि प्राप्त की, जो एक आंकड़ा है जो कई अन्य शीर्ष-स्तरीय पूर्वानुमान उपकरणों के बराबर या उनसे बेहतर है। इससे भी महत्वपूर्ण बात यह है कि प्रणाली ने अपने स्वयं के सोचने के तरीके में एक स्पष्ट खिड़की प्रदान की। जब शोधकर्ताओं ने उन अवधारणाओं की जांच की जिन्हें मॉडल ने सक्रिय किया था, तो उन्होंने पाया कि मशीन वास्तविक दुनिया की स्थितियों को सही ढंग से पहचान रही थी, जैसे कि ठंडे, शुष्क सर्दियों के ब्लॉक या वे अवधि जहाँ हवा की गति और प्रदूषण के स्तर एक दूसरे के विपरीत दिशा में चलते हैं।

इस दृष्टिकोण की शक्ति को शोधकर्ताओं द्वारा किए गए प्रयोगों की एक श्रृंखला के माध्यम से और अधिक प्रदर्शित किया गया, जहाँ उन्होंने जानबूझकर मॉडल की सोच में हस्तक्षेप किया। एक परीक्षण में, उन्होंने मॉडल की भविष्यवाणियों को लिया और उसे सही अवधारणाओं के बिल्कुल विपरीत का उपयोग करने के लिए मजबूर किया। मॉडल को यह बताने के बजाय कि हवा शांत है, उन्होंने इसे बताया कि हवा तेज चल रही है, भले ही डेटा कुछ और दिखा रहा हो। इस सरल बदलाव के कारण मॉडल की भविष्यवाणियाँ ढह गईं, जिससे त्रुटि दर 15.37 से बढ़कर 99.66 हो गई। इस नाटकीय विफलता ने साबित कर दिया कि मॉडल केवल अवधारणाओं का उपयोग एक गौण नोट के रूप में नहीं कर रहा था; बल्कि वह उन्हें अपनी भविष्यवाणियों के प्राथमिक इंजन के रूप में उपयोग कर रहा था। सिस्टम वास्तव में मानवीय विचारों का उपयोग अपना काम करने के लिए कर रहा था।

शोधकर्ताओं ने यह भी पता लगाया कि वे सटीकता और पारदर्शिता के बीच कितना समझौता कर सकते हैं। उन्होंने पाया कि एक विशिष्ट सेटिंग को समायोजित करके, वे मॉडल को अवधारणाओं पर अधिक निर्भर बना सकते हैं, भले ही इसका अर्थ यह हो कि भविष्यवाणियाँ थोड़ी कम सटीक हो जाएं। यह लचीलापन मूल्यवान है क्योंकि यह उपयोगकर्ताओं को यह चुनने की अनुमति देता है कि वे मशीन के भीतर कितना देखना चाहते हैं। कुछ मामलों में, सटीकता में मामूली गिरावट समझना या मानव दर्शकों को निर्णय समझाना सीखने के लक्ष्य के लिए सार्थक हो सकती है। सिस्टम ने जटिल संबंधों को भी सीखने की क्षमता दिखाई, जैसे कि जब हवा की गति लंबे समय तक शून्य के करीब रहती है, तो प्रदूषण का स्तर बढ़ने की प्रवृत्ति होती है, और जैसे ही हवा तेज होती है, प्रदूषण साफ हो जाता है। मॉडल ने इस पैटर्न को सीखा और इसे सरल भाषा में समझा सका, जो पारंपरिक ब्लैक-बॉक्स मॉडल नहीं कर सकते।

अंततः, यह कार्य भविष्य के लिए बुद्धिमान प्रणालियों के निर्माण के तरीके में एक बदलाव का प्रतिनिधित्व करता है। यह इस विचार से दूर जाता है कि हमें सटीकता के लिए समझ का त्याग करना चाहिए। भाषा मॉडल का उपयोग करके नियमों और अवधारणाओं को स्वचालित रूप से उत्पन्न करके, शोधकर्ताओं ने मैनुअल लेबलिंग के भारी बोझ को हटा दिया है जो आमतौर पर इस तरह की पारदर्शिता को असंभव बना देता है। सिस्टम को हर घंटे के डेटा को लेबल करने के लिए किसी इंसान के बैठने की आवश्यकता नहीं है; यह भाषा मॉडल के सुझावों के मार्गदर्शन में अपने आप पैटर्न पहचानना सीख जाता है। परिणाम एक ऐसा पूर्वानुमान उपकरण है जो शक्तिशाली और ईमानदार दोनों है, जो सटीक भविष्यवाणियां करने में सक्षम है और साथ ही अपने तर्क को समझाने में भी सक्षम है जिसे एक मानव समझ सके। यह उन्नत आर्टिफिशियल इंटेलिजेंस के उपयोग के द्वार खोलता है जहाँ विश्वास और स्पष्टता आवश्यक है, यह सुनिश्चित करता है कि जब कोई मशीन भविष्य की भविष्यवाणी करती है, तो हम जानते हैं कि वह ऐसा क्यों सोच रही है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →