← नवीनतम पेपर
💻 computer science

MeanRadius SMOTE Based Graph Neural Network for Imbalanced Node Classification in Fault and Intrusion Detection

यह शोध पत्र मीनरेडियस-SMOTE ग्राफ न्यूरल नेटवर्क (MRS-GNN) का प्रस्ताव करता है, जो एक नवीन ढांचा है जो एम्बेडिंग स्पेस में सिंथेटिक नोड्स उत्पन्न करके और ग्राफ टोपोलॉजी को संरक्षित करने के लिए विशेष किनारों (edges) का निर्माण करके दोष और घुसपैठ का पता लगाने में क्लास इम्बैलेंस (वर्ग असंतुलन) को संबोधित करता है, जिससे अत्यधिक असंतुलन की स्थितियों में वर्गीकरण सटीकता और AUC-ROC में महत्वपूर्ण सुधार होता है।

मूल लेखक: Jagannath E. Nalavade, Ramachandra Pujeri, Rajani Sajjan, Nagesh Jadhav, Amar Buchade, Dattatray Kale

प्रकाशित 2026-08-24
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Jagannath E. Nalavade, Ramachandra Pujeri, Rajani Sajjan, Nagesh Jadhav, Amar Buchade, Dattatray Kale

मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

आधुनिक उद्योग की जटिल मशीनरी और वैश्विक नेटवर्क के जटिल जाल में, सुरक्षा इस बात पर निर्भर करती है कि दुर्लभ और खतरनाक संकेतों को नुकसान पहुँचाने से पहले पहचानने की क्षमता कितनी है। चाहे वह कारखाने की मोटर में एक बेयरिंग का विफल होना शुरू होना हो या कंप्यूटर नेटवर्क पर दुर्भावनापूर्ण ट्रैफ़िक का एक सूक्ष्म पैटर्न, ये महत्वपूर्ण घटनाएँ अक्सर सामान्य, रोज़मर्रा के डेटा के विशाल समुद्र में छिपी होती हैं। यह उन कंप्यूटर प्रोग्रामों के लिए एक कठिन पहेली पैदा करता है जिन्हें इन प्रणालियों की निगरानी के लिए डिज़ाइन किया गया है। क्योंकि विफलताएं और हमले सामान्य संचालन की तुलना में बहुत कम होते हैं, इसलिए इन प्रोग्रामों को प्रशिक्षित करने के लिए उपलब्ध डेटा अत्यधिक असंतुलित होता है। प्रोग्राम स्वास्थ्य और सुरक्षा के सामान्य, उबाऊ पैटर्न को पहचानना सीख जाते हैं, लेकिन वे दुर्लभ, खतरनाक संकेतों को पहचानने में संघर्ष करते हैं क्योंकि उनके पास अध्ययन करने के लिए पर्याप्त उदाहरण नहीं होते हैं। यह असंतुलन की एक समस्या है, जहाँ कुछ महत्वपूर्ण मामलों को कई महत्वहीन मामलों द्वारा दबा दिया जाता है।

इसे हल करने के लिए, शोधकर्ताओं ने ग्राफ न्यूरल नेटवर्क नामक एक प्रकार के कृत्रिम बुद्धिमत्ता (आर्टिफिशियल इंटेलिजेंस) की ओर रुख किया है। डेटा को एक साधारण सूची या ग्रिड के रूप में देखने वाले मानक कंप्यूटर प्रोग्रामों के विपरीत, ये नेटवर्क सूचना को कनेक्शन के एक मानचित्र के रूप में देखते हैं। एक ऐसी प्रणाली की कल्पना करें जहाँ डेटा का प्रत्येक हिस्सा एक बिंदु है, और उनके बीच के संबंध उन बिंदुओं को जोड़ने वाली रेखाएँ हैं। यह संरचना कंप्यूटर को यह समझने की अनुमति देती है कि मशीन या नेटवर्क के विभिन्न हिस्से एक-दूसरे को कैसे प्रभावित करते हैं। हालाँकि, यहाँ तक कि ये उन्नत सिस्टम भी असंतुलन की समस्या का सामना करने पर लड़खड़ा जाते हैं। यदि आप केवल दुर्लभ उदाहरणों की नकल करके या उन्हें दुर्लभ मामलों पर अधिक ध्यान देने के लिए कहकर उन्हें सिखाने की कोशिश करते हैं, तो परिणाम अक्सर खराब होते हैं। कॉपी किए गए उदाहरण कनेक्शनों के जटिल जाल में फिट नहीं होते हैं, और अतिरिक्त ध्यान स्पष्टता के बजाय भ्रम पैदा करता है। नेटवर्क अंततः उन्हीं दोषों और घुसपैठों को चूक जाता है जिन्हें खोजने के लिए इसे बनाया गया था।

इसे हल करने के लिए, भारत के विश्वविद्यालयों के शोधकर्ताओं की एक टीम ने इस विशिष्ट कमजोरी को ठीक करने के लिए एक नया दृष्टिकोण विकसित किया है। उन्होंने 'मीन रेडियस-स्मोट ग्राफ न्यूरल नेटवर्क' (MeanRadius-SMOTE Graph Neural Network) या MRS-GNN नामक एक ढांचा तैयार किया है, जिसे डेटा के नाजुक ढांचे को तोड़े बिना दुर्लभ घटनाओं के विश्वसनीय नए उदाहरण उत्पन्न करने के लिए डिज़ाइन किया गया है। कच्चे, अव्यवस्थित मूल प्रारूप में नए डेटा को जबरन डालने के बजाय, शोधकर्ता पहले कंप्यूटर को डेटा को एक स्वच्छ, अधिक व्यवस्थित आंतरिक भाषा में अनुवादित करने के लिए निर्देशित करते हैं। इस सरलीकृत स्थान में, कंप्यूटर दुर्लभ घटनाओं के वास्तविक आकार को अधिक स्पष्ट रूप से देख सकता है। इसके बाद, यह मौजूदा उदाहरणों के बीच के अंतराल को सावधानीपूर्वक भरकर इन दुर्लभ दोषों के नए, सिंथेटिक उदाहरण बनाता है, यह सुनिश्चित करते हुए कि नया डेटा बिल्कुल वास्तविक चीज़ जैसा दिखे और व्यवहार करे।

इस नई पद्धति का सबसे महत्वपूर्ण हिस्सा यह है कि यह नए उदाहरणों और शेष प्रणाली के बीच के कनेक्शन को कैसे संभालती है। जब एक कंप्यूटर एक नकली उदाहरण बनाता है, तो वह अक्सर उसे नेटवर्क से अलग, अकेला छोड़ देता है। यह ग्राफ-आधारित प्रणाली के लिए एक घातक दोष है, जो दुनिया को समझने के लिए बिंदुओं को जोड़ने वाली रेखाओं पर पूरी तरह से निर्भर करती है। शोधकर्ताओं ने एक विशेष मॉड्यूल जोड़कर इसे हल किया जो एक 'पुल निर्माता' (ब्रिज बिल्डर) के रूप में कार्य करता है। यह मॉड्यूल मौजूदा कनेक्शन पैटर्न का अध्ययन करता है और सिंथेटिक उदाहरणों से वास्तविक डेटा बिंदुओं तक नई रेखाएँ खींचता है। यह सुनिश्चित करता है कि नए उदाहरण नेटवर्क के ताने-बाने में सहजता से बुने हुए हों, जिससे पूरे सिस्टम की संरचनात्मक अखंडता बनी रहे। यह कंप्यूटर को नए उदाहरणों से ठीक वैसे ही सीखने की अनुमति देता है जैसे वह वास्तविक उदाहरणों से सीखता है, और दुर्लभ घटनाओं के संदर्भ को समझने के लिए कनेक्शनों का उपयोग करता है।

टीम ने केस वेस्टर्न रिजर्व यूनिवर्सिटी और यूनिवर्सिटी ऑफ पाडरबोर्न सहित यांत्रिक दोष संबंधी जानकारी के तीन प्रसिद्ध स्रोतों के डेटा का उपयोग करके इस नए ढांचे का परीक्षण किया। उन्होंने ऐसी चरम स्थितियों का अनुकरण किया जहाँ दुर्लभ दोषों की संख्या सामान्य संचालन की तुलना में बहुत कम थी, जिससे एक ऐसी स्थिति पैदा हुई जहाँ असंतुलन गंभीर था। इन कठिन परीक्षणों में, नया सिस्टम उल्लेखनीय रूप से प्रभावी साबित हुआ। इसने एक ऐसा वर्गीकरण सटीकता (क्लासिफिकेशन एक्यूरेसी) प्राप्त की जो केवल डेटा की नकल करने वाले या वेट्स (weights) को समायोजित करने वाले पारंपरिक तरीकों से अठारह प्रतिशत से अधिक अधिक थी। इसके अलावा, जब सिस्टम की दुर्लभ दोषों और सामान्य शोर के बीच अंतर करने की क्षमता को मापा गया, तो इस नए ढांचे ने 0.904 का स्कोर प्राप्त किया, जो प्रदर्शन का एक ऐसा स्तर है जो विश्वसनीयता की बहुत उच्च डिग्री को दर्शाता है।

शोधकर्ताओं ने पाया कि यह दृष्टिकोण तब भी अच्छी तरह से काम करता है जब विभिन्न प्रकार के दोषों की संख्या बढ़ जाती है, एक ऐसी स्थिति जहाँ पुराने तरीके अक्सर विफल हो जाते हैं। नए डेटा को जुड़ा हुआ और मूल संरचना के प्रति सच्चा रखकर, सिस्टम उस भ्रम से बच जाता है जो आमतौर पर असमान डेटासेट को संतुलित करने के प्रयासों में होता है। अध्ययन बताता है कि यह विधि केवल यांत्रिक दोषों तक सीमित नहीं है बल्कि इसे कंप्यूटर नेटवर्क में घुसपैठ का पता लगाने या पावर ग्रिड की स्थिरता की निगरानी करने जैसे अन्य जटिल प्रणालियों में भी लागू किया जा सकता है। यह कार्य प्रदर्शित करता है कि डेटा में अंतर्निहित कनेक्शनों का सम्मान करके और सावधानी से नए उदाहरण बनाकर, कंप्यूटर को उन दुर्लभ और खतरनाक संकेतों को देखना सिखाना संभव है जिन्हें वे अन्यथा मिस कर देते, जिससे सुरक्षित और अधिक विश्वसनीय औद्योगिक और डिजिटल प्रणालियाँ बनती हैं।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →