Provenance Guided Incremental Learning Under Evolving Concept Definitions
यह शोध पत्र एक प्रोवेनेंस-गाइडेड इंक्रीमेंटल लर्निंग फ्रेमवर्क प्रस्तुत करता है जो स्पष्ट नियम-प्रेरित कॉन्सेप्ट शिफ्ट्स के अनुकूल होने के लिए मशीन लर्निंग मॉडल्स को कुशलतापूर्वक अनुकूलित करता है, जो प्रभावित रिकॉर्ड्स को स्वचालित रूप से पुन: लेबल करके और केवल परिवर्तित घटकों पर चुनिंदा रूप से पुन: प्रशिक्षण देकर ऐसा करता है, जिससे पूर्ण पुन: प्रशिक्षण की तुलना में उच्च सटीकता बनाए रखते हुए कम्प्यूटेशनल लेटेंसी और डेटा रीप्रोसेसिंग को काफी कम किया जा सकता है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
मशीन लर्निंग की दुनिया में, कंप्यूटर को अक्सर डेटा में पैटर्न का अध्ययन करके भविष्यवाणियां करना सिखाया जाता है। कल्पना कीजिए कि एक प्रणाली को धोखाधड़ी वाले बैंक लेनदेन को पहचानने के लिए प्रशिक्षित किया गया है। यह सीखता है कि एक सामान्य लेनदेन कैसा दिखता है और एक संदिग्ध लेनदेन कैसा दिखता है, जो इसके रचनाकारों द्वारा निर्धारित नियमों और परिभाषाओं पर आधारित होता है। हालांकि, वास्तविक दुनिया स्थिर नहीं है। वे नियम जो यह परिभाषित करते हैं कि क्या "धोखाधड़ी" माना जाए, बदल सकते हैं। एक बैंक यह तय कर सकता है कि कोई लेनदेन केवल तभी संदिग्ध है यदि वह एक निश्चित राशि से अधिक हो, या यदि वह किसी विशिष्ट देश से आता हो, या यदि इसमें किसी नए प्रकार के उपकरण का उपयोग किया गया हो। जब ये परिभाषाएं बदलती हैं, तो कंप्यूटर का पुराना प्रशिक्षण पुराना हो जाता है। जो डेटा इसने कल पढ़ा था वह वही है, लेकिन उत्तर का अर्थ बदल गया है। यह एक कठिन समस्या पैदा करता है: आप एक सीखने वाली प्रणाली को कैसे अपडेट करते हैं जब सत्य की परिभाषा ही फिर से लिख दी गई हो, बिना सब कुछ छोड़कर फिर से शुरू किए?
लंबे समय तक, शोधकर्ताओं ने इसे गलतियों पर नज़र रखकर हल किया है। वे तब तक प्रतीक्षा करते हैं जब तक कि कंप्यूटर गलतियाँ करने न लगे, यह निष्कर्ष निकालते हैं कि कुछ बदल गया है, और फिर मॉडल को समायोजित करने का प्रयास करते हैं। लेकिन यह दृष्टिकोण धीमा है और अक्सर लक्ष्य से चूक जाता है। यह परिवर्तन को एक रहस्य के रूप में मानता है जिसे अनुमान लगाकर सुलझाया जाना है, न कि एक ज्ञात तथ्य के रूप में जिस पर कार्रवाई की जानी है। कई वास्तविक दुनिया की प्रणालियों में, परिवर्तन कोई रहस्य नहीं है; यह नीति या नियम में एक जानबूझकर किया गया अपडेट है। नई परिभाषा तुरंत ज्ञात होती है। चुनौती यह पता लगाने की है कि पिछले लाखों रिकॉर्डों में से वास्तव में किनका पुनर्मूल्यांकन किया जाना चाहिए क्योंकि वे इस नए नियम से प्रभावित हैं, और किन्हें अकेला छोड़ा जा सकता है क्योंकि वे अप्रभावित हैं।
एक नया अध्ययन इस समस्या को एक अंधे अनुमान के बजाय एक सावधानीपूर्वक ऑडिट (लेखापरीक्षा) की तरह देखता है। शोधकर्ताओं ने एक ऐसी प्रणाली विकसित की है जो पुराने नियम और नए नियम को एक साथ देखती है ताकि उनके बीच के सटीक अंतर को पाया जा सके। फिर यह उस विशिष्ट अंतर को ट्रैक करती है कि वह पिछले डेटा के इतिहास से कैसे जुड़ता है। इन कनेक्शनों का पीछा करते हुए, प्रणाली उन रिकॉर्डों के एक छोटे समूह की पहचान कर सकती है जो वास्तव में परिवर्तन से प्रभावित हैं। यह भी सिद्ध कर सकती है कि रिकॉर्डों का विशाल बहुमत सुरक्षित है और उसे छूने की आवश्यकता नहीं है। यह कंप्यूटर को उसके ज्ञान को बरकरार रखते हुए, केवल डेटा के छोटे और प्रासंगिक हिस्से पर ध्यान केंद्रित करके अपने ज्ञान को अपडेट करने की अनुमति देता है।
शोधकर्ताओं ने वित्तीय लेनदेन, जनसांख्यिकीय डेटा, साइबर सुरक्षा लॉग और संबंधों के जटिल नेटवर्क सहित विभिन्न वास्तविक दुनिया के परिदृश्यों पर इस दृष्टिकोण का परीक्षण किया। उन्होंने चुनौतियों का एक सेट बनाया जहाँ डेटा को लेबल करने के नियम विभिन्न तरीकों से बदले गए थे: एक सीमा (थ्रेशोल्ड) को बढ़ाकर या घटाकर, एक नई शर्त जोड़कर, एक पुरानी शर्त को हटाकर, या विभिन्न स्थितियों को संयोजित करने के तरीके को बदलकर। हर मामले में, नई विधि ने उच्च सटीकता के साथ उन रिकॉर्डों की पहचान करने में सफलता प्राप्त की जिन्हें ध्यान देने की आवश्यकता थी। डेटाबेस के प्रत्येक रिकॉर्ड की दोबारा जांच करने के बजाय, प्रणाली ने केवल लगभग 15 प्रतिशत डेटा को ही पुन: संसाधित किया। इतने कम डेटा को देखने के बावजूद, इसने 92.3 प्रतिशत की सटीकता बनाए रखी, जो पूरे डेटाबेस की दोबारा जांच करने के परिणाम के लगभग समान था।
इस प्रक्रिया की गति सबसे उल्लेखनीय परिणाम थी। जब शोधकर्ताओं ने प्रणाली को पूरे डेटा के इतिहास को फिर से लेबल करने और पुन: प्रशिक्षित करने के लिए मजबूर किया, तो अपडेट पूरा करने में औसतन 993 सेकंड लगे। नए तरीके के साथ, उसी अपडेट में केवल 179 सेकंड लगे। यह पांच गुना से अधिक समय की कमी को दर्शाता है। प्रणाली ने एक "प्रोवेनेंस" (उत्पत्ति) मानचित्र का उपयोग करके इसे हासिल किया, जो अनिवार्य रूप से एक रिकॉर्ड है कि प्रत्येक पिछला निर्णय कैसे लिया गया था। यदि किसी पिछले निर्णय ने नियम के उस हिस्से पर भरोसा किया था जो नहीं बदला, तो प्रणाली जान जाती है कि वह निर्णय अभी भी वैध है। यदि निर्णय ने उस हिस्से पर भरोसा किया जो बदल गया, तो प्रणाली उसे समीक्षा के लिए चिह्नित करती है। यह कंप्यूटर को यह प्रमाणित करने की अनुमति देता है कि उसका अधिकांश पिछला ज्ञान अभी भी सही है और केवल उन हिस्सों पर समय खर्च करे जो टूट गए हैं।
अध्ययन ने इस बात को भी संबोधित किया कि क्या होता है जब नया नियम पूरी तरह से स्पष्ट नहीं होता है। कभी-कभी, एक संशोधित नीति ऐसी जानकारी पर निर्भर हो सकती है जो गायब है या जिसमें मानवीय निर्णय की आवश्यकता होती है। ऐसे मामलों में, प्रणाली अनुमान नहीं लगाती है। इसके बजाय, यह उन विशिष्ट रिकॉर्डों की पहचान करती है जहाँ नया नियम अस्पष्ट है और केवल उन मामलों के लिए मानव से मदद मांगती है। यह मानव विशेषज्ञों के उपयोग को बहुत अधिक कुशल बनाता है, क्योंकि वे उन रिकॉर्डों पर समय बर्बाद नहीं करते हैं जिन्हें कंप्यूटर स्वयं संभाल सकता है। इसके अलावा, प्रणाली नियमों के पिछले संस्करणों की स्मृति रखती है। यदि कोई नियम बदलता है और फिर पिछले संस्करण पर वापस आता है, तो प्रणाली तुरंत पुराने विन्यास और उसके साथ जुड़े डेटा को याद कर सकती है, जिससे उसे पैटर्न को फिर से सीखने की आवश्यकता नहीं होती।
शोधकर्ताओं ने पाया कि यह दृष्टिकोण सरल संख्या सूचियों से लेकर संबंधों के जटिल नेटवर्क तक, विभिन्न प्रकार के डेटा पर अच्छी तरह काम करता है। हालांकि, उन्होंने इसकी सीमाओं को भी नोट किया। यह विधि तब सबसे प्रभावी होती है जब नियम में परिवर्तन स्थानीयकृत हो, यानी केवल डेटा के एक छोटे हिस्से को प्रभावित करता हो। यदि एक नया नियम लगभग हर रिकॉर्ड के अर्थ को बदल देता है, तो प्रणाली को लगभग सब कुछ फिर से जांचना पड़ता है, और गति का लाभ समाप्त हो जाता है। इसी तरह, यदि यह रिकॉर्ड नहीं किया गया था कि निर्णयों का इतिहास कैसे बना, तो प्रणाली आसानी से यह नहीं बता सकती कि कौन से रिकॉर्ड सुरक्षित हैं, और उसे अधिक सतर्क होना पड़ेगा, जिससे उसे उम्मीद से अधिक डेटा की जांच करनी पड़ेगी।
अंततः, यह कार्य सीखने वाली प्रणालियों के अनुकूलन के दृष्टिकोण को बदल देता है। त्रुटियों के प्रकट होने की प्रतीक्षा करने और फिर प्रतिक्रिया देने के बजाय, प्रणाली नियम परिवर्तन के स्पष्ट ज्ञान का उपयोग करके अपने ज्ञान को सर्जिकल सटीकता के साथ अपडेट कर सकती है। यह सिद्ध करता है कि परिवर्तन की संरचना और इतिहास के साथ इसके संबंध को समझकर, एक कंप्यूटर जो पहले से जानता है उसे संरक्षित करते हुए उसे कुशलतापूर्वक ठीक कर सकता है। यह सीखने वाली प्रणालियों को लंबे समय तक सटीक और उत्तरदायी रहने की अनुमति देता है, जिससे वे निरंतर, पूर्ण पुन: प्रशिक्षण की भारी लागत के बिना नई नीतियों के अनुकूल हो सकती हैं।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।