FL-GWO: A Federated Learning and Grey Wolf Optimization Framework for Blockchain-Assisted Trust Management in Decentralized IoT-Edge Systems
यह शोध पत्र FL-GWO का प्रस्ताव करता है, जो एक नवीन ढांचा है जो फेडरेटेड लर्निंग को ग्रे वुल्फ ऑप्टिमाइज़ेशन और ब्लॉकचेन तकनीक के साथ एकीकृत करता है ताकि स्वार्म इंटेलिजेंस के माध्यम से ट्रस्ट मापदंडों को गतिशील रूप से अनुकूलित करके विकेंद्रीकृत IoT-एज सिस्टम में गोपनीयता-संरक्षित, अनुकूलन योग्य और सुदृढ़ ट्रस्ट प्रबंधन को सक्षम किया जा सके।
मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
आधुनिक दुनिया को शक्ति प्रदान करने वाले विशाल, अदृश्य नेटवर्क में, अरबों छोटे उपकरण—खेतों में स्मार्ट सेंसर से लेकर शहरों में ट्रैफिक मॉनिटर तक—बिना किसी केंद्रीय बॉस के निर्णय लेने के लिए मिलकर काम करते हैं। यह इंटरनेट ऑफ थिंग्स (IoT) का क्षेत्र है, जहाँ चीज़ें सुचारू रूप से चलती रहने के लिए कंप्यूटर, कंप्यूटर से बात करते हैं। लेकिन जब ये उपकरण एक विशाल क्षेत्र में बिखरे होते हैं, तो एक-दूसरे पर भरोसा करना एक कठिन पहेली बन जाता है। यदि कोई उपकरण अजीब व्यवहार करने लगे, शायद इसलिए क्योंकि उसकी बैटरी खत्म हो रही है या किसी हैकर ने उस पर नियंत्रण कर लिया है, तो पूरा सिस्टम अराजकता में जा सकता है। कौन भरोसेमंद है, इसकी जाँच करने के पारंपरिक तरीके अक्सर कठोर नियमों या एक केंद्रीय प्राधिकरण पर निर्भर करते हैं जो सारा डेटा एकत्र करता है, लेकिन ये दृष्टिकोण वास्तविक दुनिया की तेज़ी से बदलती, जटिल वास्तविकता के अनुकूल होने में संघर्ष करते हैं और अक्सर शामिल उपकरणों की गोपनीयता की रक्षा करने में विफल रहते हैं।
इसे हल करने के लिए, शोधकर्ताओं ने दो शक्तिशाली विचारों की ओर रुख किया है। पहला तरीका है कंप्यूटर को एक साथ सीखने का प्रशिक्षण देना, बिना कभी भी अपने निजी रहस्य साझा किए। कल्पना कीजिए कि पड़ोसियों का एक समूह है जो एक विशिष्ट प्रकार के इंजन को ठीक करना सीखना चाहता है, लेकिन उनमें से कोई भी नहीं चाहता कि कोई दूसरा उनके व्यक्तिगत औजारों या नोट्स को देख सके। इसके बजाय, वे प्रत्येक स्वयं अभ्यास करते हैं, केवल उन सामान्य सबक को लिखते हुए जो उन्होंने सीखे हैं, और उन नोट्स को एक केंद्रीय शिक्षक के साथ साझा करते हैं जो उन्हें एक मास्टर गाइड में संयोजित करता है। यह विधि, जिसे फेडरेटेड लर्निंग (federated learning) कहा जाता है, समूह को अपनी निजी जानकारी सुरक्षित रखते हुए स्मार्ट बनने की अनुमति देती है। दूसरा विचार प्रकृति से आता है: ग्रे वुल्फ (धूसर भेड़िये) के शिकार करने का तरीका। एक भेड़िये के झुंड में, नेता समूह को शिकार की ओर निर्देशित करते हैं, और सबसे अच्छे मार्ग को खोजने के लिए लगातार अपनी स्थिति को समायोजित करते हैं। एक साथ मिलकर इष्टतम समाधान खोजने की इस प्राकृतिक रणनीति को एक कंप्यूटर एल्गोरिदम में अनुवादित किया गया है जो झुंड के पदानुक्रम और गति की नकल करके जटिल समस्याओं को हल कर सकता है।
लक्ष्मी नारायण कॉलेज ऑफ टेक्नोलॉजी, भारत के शोधकर्ताओं की एक टीम ने इन दोनों अवधारणाओं को एक नए सिस्टम में संयोजित किया है जिसे विकेंद्रीकृत नेटवर्क को सुरक्षित और ईमानदार रखने के लिए डिज़ाइन किया गया है। वे अपनी इस रचना को FL-GWO कहते हैं, एक ऐसा ढांचा जो विश्वास (trust) प्रबंधित करने के लिए फेडरेटेड लर्निंग की गोपनीयता और ग्रे वुल्फ एल्गोरिदम की स्मार्ट खोज शक्ति का उपयोग करता है। उनके सिस्टम में, नेटवर्क में प्रत्येक उपकरण यह निर्णय लेने के लिए अपना स्थानीय मॉडल प्रशिक्षित करता है कि क्या उसके पड़ोसी अच्छा व्यवहार कर रहे हैं। कच्चे डेटा को भेजने के बजाय जो वह देखता है, उपकरण केवल अपडेट किए गए नियमों को भेजता है जो उसने सीखे हैं। ये नियम फिर एक केंद्रीय केंद्र (central hub) को भेजे जाते हैं, केवल साधारण औसत निकालने के लिए नहीं, बल्कि ग्रे वुल्फ एल्गोरिदम द्वारा परिष्कृत करने के लिए। यह एल्गोरिदम अब तक मिले तीन सर्वश्रेष्ठ समाधानों को एक शिकार की तरह उपयोग करता है, जो बाकी समूह को व्यवहार के सटीक निर्णय लेने के बेहतर तरीके की ओर निर्देशित करते हैं। एक बार जब नियमों का सबसे अच्छा सेट मिल जाता है, तो इसे वापस सभी उपकरणों को भेजा जाता है, जिससे एक निरंतर लूप बनता है जहाँ नेटवर्क लगातार सीखता है और नए खतरों के प्रति अनुकूलित होता है।
यह सुनिश्चित करने के लिए कि इन विश्वास रिकॉर्ड के साथ छेड़छाड़ न की जा सके, शोधकर्ताओं ने अपने सिस्टम को ब्लॉकचेन से भी जोड़ा है, जो एक डिजिटल लेज़र है जो एक स्थायी, अपरिवर्तनीय डायरी के रूप में कार्य करता है। हर बार जब नेटवर्क अपने विश्वास नियमों को अपडेट करता है, तो वह परिवर्तन इस लेज़र पर दर्ज किया जाता है, जिससे एक पारदर्शी इतिहास बनता है जिसे हर कोई सत्यापित कर सकता है लेकिन कोई बदल नहीं सकता। यह सेटअप सुनिश्चित करता है कि यदि कोई उपकरण अपने पिछले व्यवहार के बारे में झूठ बोलने की कोशिश भी करता है, तो अपरिवर्तनीय रिकॉर्ड सच्चाई को उजागर कर देगा। शोधकर्ताओं ने अपने सिस्टम का परीक्षण पचास उपकरणों के साथ एक सिम्युलेटेड वातावरण में किया, जिसमें ईमानदार, दोषपूर्ण और हैकर्स की तरह व्यवहार करने के लिए डिज़ाइन किए गए दुर्भावनापूर्ण (malicious) उपकरण शामिल थे। उन्होंने अपने नए तरीके की तुलना पुराने तकनीकों से की जो निश्चित नियमों या सरल औसत का उपयोग करती थीं। परिणामों ने दिखाया कि नया सिस्टम बुरे तत्वों को पहचानने में काफी बेहतर था। इसने 93.2% बार भरोसेमंद उपकरणों की सही पहचान की, जबकि पुराने तरीके संघर्ष करते रहे, जिनमें से कुछ दुर्भावनापूर्ण उपकरणों को पहचानने में लगभग 15% बार विफल रहे।
शायद सबसे महत्वपूर्ण बात यह है कि सिस्टम अविश्वसनीय रूप से लचीला साबित हुआ। यहाँ तक कि जब शोधकर्ताओं ने नेटवर्क में दुर्भावनापूर्ण उपकरणों की संख्या बढ़ाकर 40% कर दी—एक ऐसी स्थिति जहाँ अधिकांश अन्य सिस्टम विफल हो जाते—तब भी इस नए ढांचे ने 89.5% की सटीकता बनाए रखी। ऐसा इसलिए है क्योंकि ग्रे वुल्फ एल्गोरिदम स्थिर नहीं है; यह तुरंत अपना ध्यान बदल सकता है। यदि कोई उपकरण जिस पर पहले भरोसा किया गया था, अचानक संदिग्ध व्यवहार करने लगता है, तो सिस्टम तुरंत विभिन्न व्यवहारों, जैसे कि वह संदेश कितनी तेज़ी से भेजता है या कितनी ऊर्जा का उपयोग करता है, को पकड़ने के लिए अलग-अलग भार (weight) को समायोजित करता है। अध्ययन में यह भी पाया गया कि इस उच्च स्तर की सुरक्षा ने गति की कीमत पर समझौता नहीं किया; सिस्टम संचार के केवल 85 राउंड में एक समाधान पर पहुँच गया, जो प्रतिस्पर्धी तरीकों की तुलना में तेज़ था। हालाँकि शोधकर्ता नोट करते हैं कि सिस्टम का परीक्षण एक सिमुलेशन में किया गया था, और वास्तविक दुनिया में तैनाती के लिए बड़े पैमाने और जटिल गोपनीयता आवश्यकताओं को संभालने के लिए आगे के काम की आवश्यकता होगी, लेकिन निष्कर्ष एक आशाजनक मार्ग सुझाते हैं। उपकरणों को बिना रहस्य साझा किए एक साथ सीखने देने और सर्वोत्तम नियम खोजने के लिए प्रकृति-प्रेरित तर्क का उपयोग करने से, यह दृष्टिकोण विकेंद्रीकृत भविष्य को सुरक्षित और विश्वसनीय रखने का एक मजबूत तरीका प्रदान करता है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।