Metaplasticity as adaptive gradient preconditioning for incremental learning
यह शोध पत्र SynGAP को प्रस्तुत करता है, जो एक टास्क-फ्री (कार्य-मुक्त) निरंतर शिक्षण ढांचा है जो फिशर इंफॉर्मेशन मैट्रिक्स के एक्सपोनेंशियल मूविंग एवरेज का उपयोग करके एडेप्टिव ग्रेडिएंट प्रीकंडीशनिंग के माध्यम से जैविक सिनैप्टिक मेटाप्लास्टिसिटीिटी (synaptic metaplasticity) की नकल करता है, जिससे बिना किसी कार्य लेबल या व्यापक मेमोरी की आवश्यकता के मौजूदा बेसलाइनों की तुलना में बेहतर सटीकता और कम कैटास्ट्रोफिक फॉरगेटिंग (विनाशकारी विस्मृति) प्राप्त होती है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
मानव मस्तिष्क में निरंतर सीखने की एक अद्भुत क्षमता होती है। एक बच्चा कुत्ते को पहचानना सीख सकता है, फिर साइकिल चलाना सीख सकता है, और फिर एक नई भाषा सीख सकता है, और यह सब वह कुत्ते की पहचान करने के तरीके को भूले बिना कर सकता है। ज्ञान का यह निर्बाध प्रवाह पुराने अनुभवों को मिटाता नहीं है। इसके विपरीत, कृत्रिम बुद्धिमत्ता (AI) प्रणालियाँ, जो मस्तिष्क से प्रेरित गणितीय मॉडलों पर आधारित हैं, इसी कार्य में गहराई से संघर्ष करती हैं। जब ये कंप्यूटर प्रोग्राम कोई नया कार्य सीखते हैं, तो वे अक्सर "विनाशकारी विस्मृति" (catastrophic forgetting) का शिकार होते हैं, एक ऐसी घटना जहाँ नया सीखना पुराने को हिंसक रूप से मिटा देता है। सिस्टम अस्थिर हो जाता है, वर्तमान को समझने की कोशिश में अपने अतीत को थामने में असमर्थ हो जाता है। वैज्ञानिक लंबे समय से इस "स्थिरता-लचीलापन द्वंद्व" (stability-plasticity dilemma) को हल करने की कोशिश कर रहे हैं, यह खोजने का प्रयास कर रहे हैं कि मशीनें नई चीजें सीखने के लिए पर्याप्त लचीली और जो पहले से जानते हैं उसे बनाए रखने के लिए पर्याप्त स्थिर कैसे हों।
द दशकों से, शोधकर्ताओं ने अतिरिक्त नियम जोड़कर या बाद में समीक्षा करने के लिए पुराने डेटा को सहेजकर मस्तिष्क के समाधान की नकल करने की कोशिश की है। हालाँकि, इन दृष्टिकोणों के लिए अक्सर कंप्यूटर को यह जानने की आवश्यकता होती है कि एक कार्य कब समाप्त हुआ और दूसरा कब शुरू हुआ, या उन्हें पिछले उदाहरणों को संग्रहीत करने के लिए भारी मात्रा में मेमोरी की आवश्यकता होती है। ये आवश्यकताएं कृत्रिम लगती हैं और यह प्रतिबिंबित नहीं करतीं कि जैविक बुद्धिमत्ता वास्तव में कैसे कार्य करती है। सिडनी विश्वविद्यालय के शोधकर्ताओं का एक नया अध्ययन एक अलग मार्ग प्रस्तावित करता है। कंप्यूटर को पुराना डेटा याद रखने के लिए मजबूर करने या कार्य समाप्त होने के बाद महत्व की गणना करने के लिए रुकने के बजाय, वे सुझाव देते हैं कि सिस्टम को वास्तविक समय में, क्षण-प्रति-क्षण, अपनी स्वयं की सीखने की गति को समायोजित करना चाहिए, ठीक वैसे ही जैसे एक जीवित सिनैप्स (synapse) करता है। वे इस दृष्टिकोण को 'SynGAP' कहते हैं, एक ऐसी विधि जो सीखने की प्रक्रिया को अलग-अलग चरणों की एक श्रृंखला के रूप में नहीं, बल्कि एक निरंतर बहती नदी के रूप में देखती है जहाँ धारा स्वाभाविक रूप से किनारों को आकार देती है।
इसका मूल विचार 'मेटाप्लास्टिसिटी' (metaplasticity) नामक एक जैविक अवधारणा से प्रेरित है। मस्तिष्क में, एक सिनैप्स केवल चालू या बंद होने वाला साधारण स्विच नहीं है; इसका एक इतिहास होता है। एक सिनैप्स की स्थिति इस बात पर निर्भर करती है कि अतीत में उसका कितना उपयोग किया गया है, जिससे वह दोबारा बदलने के लिए अधिक या कम संभावित हो जाता है। यह "प्लास्टिसिटी की प्लास्टिसिटी" है। यदि एक संबंध को लंबे समय तक मजबूत किया गया है, तो मस्तिष्क उसे बदलना कठिन बना देता है, जिससे उस स्मृति की रक्षा होती है। यदि कोई संबंध नया या अप्रयुक्त है, तो वह लचीला बना रहता है। शोधकर्ताओं ने महसूस किया कि कृत्रिम तंत्रिका नेटवर्क (artificial neural networks) इस सिद्धांत से लाभ उठा सकते हैं। यह तय करने के लिए कि नेटवर्क के कौन से हिस्से महत्वपूर्ण हैं, कार्य पूरा होने तक प्रतीक्षा करने के बजाय, उनकी विधि नेटवर्क को अपने इतिहास की निरंतर निगरानी करने की अनुमति देती है। यह इस बात का एक चलता-फिरता औसत रखता है कि नेटवर्क के प्रत्येक हिस्से ने पिछले शिक्षण में कितना योगदान दिया है, प्रभावी रूप से महत्व की एक स्मृति बनाता है जो हर नए डेटा के साथ अपडेट होती रहती है।
इसे व्यवहार में लाने के लिए, टीम ने एक ऐसा सिस्टम विकसित किया है जो सीखने की प्रक्रिया के लिए एक गतिशील वाल्व (dynamic valve) की तरह कार्य करता है। जब कंप्यूटर कुछ नया सीखने की कोशिश करता है, तो वह अपने प्रदर्शन में सुधार के लिए आवश्यक मानक समायोजन की गणना करता है। हालाँकि, इन समायोजनों को लागू करने से पहले, वे एक फिल्टर से गुजरते हैं। यह फिल्टर प्रत्येक कनेक्शन के इतिहास की जाँच करता है। यदि कोई कनेक्शन पिछले कार्यों के लिए महत्वपूर्ण रहा है, तो फिल्टर परिवर्तन को धीरे से धीमा कर देता है, जिससे नया सीखना पुराने को नष्ट करने से बच जाता है। यदि कनेक्शन महत्वपूर्ण नहीं है, तो फिल्टर परिवर्तन को स्वतंत्र रूप से होने देता है। महत्वपूर्ण रूप से, यह सब बिना कंप्यूटर को यह जाने की आवश्यकता के होता है कि वह वर्तमान में क्या कार्य कर रहा है, और बिना पुराने उदाहरणों के बड़े पुस्तकालय को स्टोर किए। सिस्टम बस आगे बढ़ता है, जो उसने पहले ही सीखा है उसके आधार पर अपनी संवेदनशीलता को समायोजित करता है।
शोधकर्ताओं ने इस दृष्टिकोण का परीक्षण दो चुनौतीपूर्ण बेंचमार्क पर किया जहाँ एक कंप्यूटर को एक के बाद एक छवियों की विभिन्न श्रेणियों को पहचानना होता है। एक परीक्षण में, सिस्टम को छवियों के दस समूहों में विभाजित 100 अलग-अलग वर्गों को सीखना था। मानक शिक्षण विधियाँ, जो केवल चलते समय त्रुटियों को कम करने की कोशिश करती हैं, पहले समूहों को लगभग पूरी तरह से भूल गईं, पुराने कार्यों पर 10% से भी कम सटीकता बनाए रखीं। वे विधियाँ जिन्होंने पुराने डेटा को बचाने या सीखने की प्रक्रिया में अतिरिक्त दंड जोड़ने का प्रयास किया, उन्होंने बेहतर प्रदर्शन किया लेकिन फिर भी संघर्ष किया, अक्सर अपने द्वारा सीखे गए आधे से अधिक हिस्से को भूल गईं। हालाँकि, नई SynGAP विधि ने सफलता का काफी उच्च स्तर प्राप्त किया। इसने पुराने कार्यों पर लगभग 27% की औसत सटीकता बनाए रखी, जो मानक नियमितीकरण (regularization) विधि से चार गुना अधिक और पुराने डेटा को सहेजने वाली विधि से लगभग 10% बेहतर है। इसने स्थापित तकनीकों की तुलना में विस्मृति के स्तर को 10% से अधिक कम भी किया।
वस्तु पहचान के निरंतर प्रवाह वाले दूसरे परीक्षण में, परिणाम समान रूप से मजबूत थे। नई विधि ने लगभग 68% की सटीकता प्राप्त की, जो सर्वश्रेष्ठ मानक शिक्षण उपकरणों से लगभग 10 प्रतिशत अंक अधिक है। शायद सबसे महत्वपूर्ण बात यह है कि सिस्टम कठोर नहीं हुआ। कुछ विधियाँ जो पुरानी स्मृतियों की बहुत अच्छी तरह से रक्षा करती हैं, वे कंप्यूटर के लिए कुछ भी नया सीखना असंभव बना देती हैं। शोधकर्ताओं ने पाया कि उनका दृष्टिकोण एक नाजुक संतुलन बनाता है: इसने भविष्य को फ्रीज किए बिना अतीत की रक्षा की। सिस्टम नए सूचनाओं के अनुकूल होने के लिए पर्याप्त लचीला बना रहा और साथ ही अपने पुराने ज्ञान की मूल संरचना को भी सुरक्षित रखा।
इस दृष्टिकोण की सफलता इस बात में निहित है कि यह सीखने के अपडेट की प्रकृति को कैसे बदल देता है। पारंपरिक विधियाँ अक्सर अंतिम लक्ष्य में दंड जोड़कर समस्या को ठीक करने की कोशिश करती हैं, जो अनिवार्य रूप से कंप्यूटर को कहती हैं, "जहाँ तुम थे उससे बहुत दूर मत जाओ।" यह सीखने के पथ को विकृत कर सकता है और जैसे-जैसे कार्यों की संख्या बढ़ती है, संघर्ष पैदा कर सकता है। इसके विपरीत, नई विधि सीखने के चरण (learning step) को ही संशोधित करती है। यह एक ज्यामितीय मार्गदर्शक (geometric guide) के रूप में कार्य करती है, कंप्यूटर को उन दिशाओं से दूर ले जाती है जो पुरानी स्मृतियों को नष्ट कर देंगी, जबकि उन दिशाओं में स्वतंत्र रूप से आगे बढ़ने की अनुमति देती है जो हस्तक्षेप नहीं करती हैं। यह निरंतर होता है, जो डेटा के प्रवाह द्वारा संचालित होता है, न कि बाहरी संकेतों या संग्रहीत स्मृतियों द्वारा। शोधकर्ताओं ने प्रदर्शित किया कि इस जैविक प्रक्रिया को गणितीय रूप से औपचारिक बनाकर, वे एक ऐसा सिस्टम बना सकते हैं जो मजबूत और कुशल दोनों है, जिसे संचालित करने के लिए बहुत कम अतिरिक्त मेमोरी की आवश्यकता होती है।
हालाँकि यह प्रणाली अत्यधिक प्रभावी है, शोधकर्ता नोट करते हैं कि यह हर संभव परिदृश्य के लिए पूर्ण समाधान नहीं है। यह वर्तमान में नेटवर्क की आंतरिक ज्यामिति के एक सरलीकृत दृश्य पर निर्भर करती है, जो कई मामलों में अच्छा काम करता है लेकिन अत्यंत जटिल समस्याओं के लिए इसमें सुधार की आवश्यकता हो सकती है। इसे कार्य करने के लिए अभी भी थोड़े डेटा को संग्रहीत करने की आवश्यकता होती है, हालांकि यह पिछली विधियों की तुलना में बहुत कम है। इन सीमाओं के बावजूद, यह कार्य एक महत्वपूर्ण प्रगति प्रदान करता है। यह दिखाता है कि जैविक प्रणालियाँ स्थिरता और परिवर्तन के बीच के तनाव को कैसे प्रबंधित करती हैं, इस पर बारीकी से नज़र रखकर और उन सिद्धांतों को एक निरंतर, वास्तविक समय की प्रक्रिया में अनुवादित करके, हम एक ऐसी कृत्रिम बुद्धिमत्ता बना सकते हैं जो एक जीवित मन की तरह सीखती है। अध्ययन बताता है कि विनाशकारी विस्मृति को रोकने की कुंजी सीखने को रोकना या अतीत को जमाखोरी करना नहीं है, बल्कि सीखने के इतिहास को इस तरह से आकार देना है कि भविष्य कैसे सीखा जाए।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।