NICE: Scale-Stable Perturbations for Graph Neural Network Explanations via Noise Corruption
यह शोध पत्र NICE को प्रस्तुत करता है, जो ग्राफ न्यूरल नेटवर्क के लिए एक नवीन स्पष्टीकरण ढांचा (explanation framework) है, जो "स्केल ड्रिफ्ट" (Scale Drift) को समाप्त करने और एक स्टोकेस्टिक रेस्टोरेशन बाउंड्री (Stochastic Restoration Boundary) के माध्यम से अधिक निष्ठावान एज एट्रिब्यूशन (edge attributions) उत्पन्न करने के लिए वितरण-शिफ्टिंग एलिमेंट-वाइज मास्किंग (distribution-shifting Element-wise Masking) को स्केल-स्टेबल नॉइज़ करप्शन (scale-stable Noise Corruption) से प्रतिस्थापित करता है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
आर्टिफिशियल इंटेलिजेंस की दुनिया में, ग्राफ न्यूरल नेटवर्क के रूप में ज्ञात प्रणालियों का एक बढ़ता हुआ वर्ग है। ये आपके फोन में पाए जाने वाले मानक इमेज-रिकग्निशन टूल्स नहीं हैं; इसके बजाय, इन्हें उस डेटा को समझने के लिए डिज़ाइन किया गया है जो कनेक्शनों के जाल के रूप में मौजूद होता है, जैसे कि एक रासायनिक यौगिक में अणु, सामाजिक नेटवर्क, या यातायात मार्ग। निर्णय लेने के लिए, ये प्रणालियाँ नोड्स के बीच के लिंक के माध्यम से सूचना प्रसारित करती हैं, ठीक वैसे ही जैसे भीड़ में कोई अफवाह फैलती है। क्योंकि ये प्रणालियाँ अविश्वसनीय रूप से जटिल हैं और इनका आंतरिक तर्क अक्सर एक उलझा हुआ 'ब्लैक बॉक्स' होता है, इसलिए वैज्ञानिकों ने "एक्सप्लेनर्स" (explainers) विकसित किए हैं। ये वे उपकरण हैं जिन्हें एक अंतिम निर्णय को देखने और यह बताने के लिए डिज़ाइन किया गया है कि कौन से विशिष्ट कनेक्शन या सूचना के टुकड़े सबसे महत्वपूर्ण थे। इन उपकरणों के काम करने का मानक तरीका "क्या होगा यदि" (what if) का खेल खेलना है। वे एक विशिष्ट कनेक्शन को लेते हैं, उसे हटा देते हैं या उसे शांत कर देते हैं, और फिर AI से पूछते हैं: "क्या आपका उत्तर बदल जाता है?" यदि उत्तर नाटकीय रूप रूप से बदल जाता है, तो वह उपकरण मान लेता है कि वह कनेक्शन महत्वपूर्ण था। यह विधि वर्षों से उद्योग का मानक रही है, लेकिन यह एक नाजुक धारणा पर निर्भर करती है: कि एक कनेक्शन को हटाने की क्रिया अनजाने में पूरे सिस्टम को इस तरह से नहीं तोड़ देती है जिसका उस कनेक्शन से कोई लेना-देना न हो।
सेंट्रल साउथ यूनिवर्सिटी, हॉन्ग कॉन्ग पॉलिटेक्निक यूनिवर्सिटी और ग्रिफ़िथ यूनिवर्सिटी के शोधकर्ताओं की एक टीम ने पाया है कि यह मानक विधि मौलिक रूप से त्रुटिपूर्ण है। उन्होंने पाया कि जिस तरह से ये व्याख्याकार (explainers) कनेक्शनों को शांत करते हैं, वह एक छिपा हुआ विरूपण (distortion) पैदा करता है जो AI के उत्तरों को अविश्वसनीय बना देता है। जब एक व्याख्याकार नेटवर्क में एक लिंक को "बंद" करने की कोशिश करता है, तो वह आमतौर पर उस लिंक के माध्यम से बहने वाली सूचना को शून्य के करीब की संख्या से गुणा कर देता है। जबकि यह विशिष्ट संदेश को रोकने में सफल होता है, यह पूरे नेटवर्क में बहने वाली सूचना की समग्र मात्रा को भी कम कर देता है। शोधकर्ता इस घटना को "स्केल ड्रिफ्ट" (Scale Drift) कहते हैं। इसकी कल्पना एक ऐसी बातचीत के रूप में करें जहाँ आप किसी व्यक्ति को अपने दोस्त को एक रहस्य फुसफुसाकर बताने के लिए कहते हैं, लेकिन ऐसा करने में, आप गलती से कमरे में मौजूद सभी लोगों को उनके सामान्य वॉल्यूम के एक अंश पर बोलने के लिए मजबूर कर देते हैं। रहस्य गायब हो सकता है, लेकिन पूरी बातचीत भी धुंधली और विकृत हो गई है। AI, इस सिकुड़े हुए सिग्नल को प्राप्त करते हुए, अपना निर्णय इसलिए नहीं बदलता क्योंकि रहस्य महत्वपूर्ण था, बल्कि इसलिए बदलता है क्योंकि पूरा कमरा इतना शांत हो गया है कि कुछ भी स्पष्ट रूप से सुनाई न दे। शोधकर्ताओं ने प्रदर्शित किया कि यह ड्रिफ्ट हर उस चरण के साथ जमा होता है जिससे सूचना नेटवर्क के माध्यम से गुजरती है, जिसका अर्थ है कि नेटवर्क जितना गहरा जाएगा, AI की आंतरिक स्थिति वास्तविकता से उतनी ही दूर भटक जाएगी, जिससे व्याख्या अविश्वसनीय हो जाएगी।
इसे हल करने के लिए, शोधकर्ताओं ने AI का परीक्षण करने का एक नया तरीका प्रस्तावित किया जो सिग्नल को छोटा करने से बचता है। कनेक्शन को केवल शांत करने के बजाय, उन्होंने "नॉइज़ करप्शन" (Noise Corruption) नामक एक विधि पेश की। संदेश को स्पष्ट रूप से हटाने के बजाय, यह विधि संदेश को एक यादृच्छिक (random), बिखरे हुए संस्करण से बदल देती है जिसमें ठीक उतनी ही समग्र शक्ति या "लौडनेस" होती है। यह एक स्पष्ट वाक्य को शोर के एक झटके से बदलने जैसा है जो मूल आवाज के समान ही तेज़ है। सूचना दूषित हो जाती है, लेकिन नेटवर्क में बहने वाली ऊर्जा स्थिर रहती है। वॉल्यूम को स्थिर रखकर, शोधकर्ताओं ने यह सुनिश्चित किया कि AI के उत्तर में कोई भी परिवर्तन विशिष्ट अर्थ के नुकसान के कारण था, न कि सिस्टम की समग्र शक्ति के पतन के कारण। उन्होंने इस विचार के इर्द-गिर्द एक नया ढांचा बनाया, जिसे उन्होंने NICE नाम दिया। यह प्रणाली पहले यह सीखती है कि AI को उसके मूल निर्णय पर वापस लाने के लिए कितनी सूचना को बहाल करने की आवश्यकता है, और फिर यह गणना करती है कि किन कनेक्शनों ने उस बहाली में सबसे अधिक योगदान दिया।
इस नए दृष्टिकोण के परिणाम महत्वपूर्ण थे। रासायनिक अणुओं और अन्य जटिल संरचनाओं से जुड़े आठ अलग-अलग बेंचमार्क पर परीक्षण किए जाने पर, नई विधि ने सर्वश्रेष्ठ मौजूदा उपकरणों को पछाड़ दिया। यह सटीक महत्वपूर्ण कनेक्शनों को अधिक सटीकता से पहचानने में सक्षम था, जिसने पिछले सर्वोत्तम तरीकों की तुलना में सही उत्तर खोजने की अपनी क्षमता में औसतन लगभग नौ प्रतिशत का सुधार किया। इससे भी महत्वपूर्ण बात यह है कि शोधकर्ताओं ने पुष्टि की कि उनकी नई तकनीक ने "स्केल ड्रिफ्ट" की समस्या को सफलतापूर्वक समाप्त कर दिया है। जब उन्होंने कनेक्शनों को शांत करने की पुरानी विधि की तुलना शोर जोड़ने की अपनी नई विधि से की, तो पुरानी विधि ने लगातार AI की आंतरिक स्थिति को उसके सामान्य ऑपरेटिंग रेंज से बहुत दूर धकेल दिया, जबकि नई विधि ने AI की आंतरिक स्थिति को किसी भी बदलाव से पहले के व्यवहार के बहुत करीब रखा। यह सुझाव देता है कि वर्षों से, कई व्याख्याएँ जो AI द्वारा उत्पन्न की गई थीं, भ्रामक रही होंगी, इसलिए नहीं कि AI गलत था, बल्कि इसलिए कि उसे समझाने के लिए उपयोग किए जाने वाले उपकरण अनजाने में उसी सिस्टम को तोड़ रहे थे जिसे वे समझने की कोशिश कर रहे थे। डेटा को बाधित करने के तरीके को ठीक करके, शोधकर्ताओं ने इन जटिल नेटवर्क के भीतर देखने का एक अधिक निष्ठावान तरीका प्रदान किया है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।