← नवीनतम पेपर
📊 statistics

Hide&Seek: Learning to Explain in an End-to-End Differentiable Network

यह शोध पत्र Hide&Seek प्रस्तुत करता है, जो एक एंड-टू-एंड डिफरेंशिएबल फ्रेमवर्क है इंस्टेंस-वाइज फीचर सिलेक्शन के लिए, जो फीचर रिमूवल को एक डिफरेंशिएबल ऑपरेशन के रूप में पुनर्गठित करके और पार्सिमनी-वेट एनिलिंग के माध्यम से ट्रेनिंग को स्थिर करके बिना किसी सूचना रिसाव (इन्फॉर्मेशन लीकेज) के फीचर सिलेक्शन और प्रेडिक्शन को संयुक्त रूप से सीखता है।

मूल लेखक: Tal Ellinson, Hadi Mohasel Afshar, Sally Cripps

प्रकाशित 2026-08-18
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Tal Ellinson, Hadi Mohasel Afshar, Sally Cripps

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

आधुनिक दुनिया में, कंप्यूटरों से तेजी से ऐसे निर्णय लेने के लिए कहा जा रहा है जो मानव जीवन को प्रभावित करते हैं, जैसे कि ऋण (लोन) को मंजूरी देना या बीमारियों का निदान करना। ये प्रणालियाँ, जिन्हें अक्सर 'ब्लैक-बॉक्स मॉडल' कहा जाता है, शक्तिशाली हैं क्योंकि वे डेटा की विशाल मात्रा में जटिल पैटर्न खोज सकती हैं, लेकिन वे अपारदर्शी भी हैं। वे हमें उत्तर तो बता सकती हैं, लेकिन शायद ही कभी यह बताती हैं कि वे उस नतीजे तक कैसे पहुँचीं। इन प्रणालियों पर भरोसा करने के लिए, वैज्ञानिकों और नीति निर्माताओं को यह समझने की आवश्यकता है कि कंप्यूटर ने अपने निर्णय के लिए जानकारी के किन विशिष्ट टुकड़ों पर भरोसा किया। यह 'फीचर सिलेक्शन' (विशेषता चयन) का क्षेत्र है: एक डेटासेट में सबसे महत्वपूर्ण चरों (वेरिएबल्स) की पहचान करने की कला। जबकि शुरुआती तरीकों ने उन विशेषताओं की तलाश की जो लोगों के पूरे समूह के लिए महत्वपूर्ण थीं, एक अधिक हालिया और आवश्यक दृष्टिकोण व्यक्तिगत मामलों पर ध्यान केंद्रित करता है। एक विशेषता जो एक मरीज के लिए महत्वपूर्ण हो सकती है, वह दूसरे के लिए अप्रासंगिक हो सकती है, ठीक वैसे ही जैसे एक विशिष्ट लक्षण एक व्यक्ति में दिल के दौरे का संकेत दे सकता है, जबकि दूसरे में यह घबराहट (एंग्जायटी) का संकेत हो सकता है। चुनौती एक ऐसा सिस्टम बनाने की रही है जो हर एक व्यक्ति के लिए गतिशील रूप से यह तय कर सके कि कौन से तथ्य वास्तव में प्रासंगिक हैं, बिना सटीकता खोए या खुद को धोखा दिए।

सिडनी यूनिवर्सिटी ऑफ टेक्नोलॉजी के शोधकर्ताओं ने इस समस्या को हल करने के लिए 'हाइड एंड सीक' (Hide&Seek) नामक एक नई विधि विकसित की है। उनका कार्य उन सूक्ष्म लेकिन महत्वपूर्ण खामियों को संबोधित करता है जो कंप्यूटर को खुद को समझाने के लिए सिखाने के पिछले प्रयासों में पाई गई थीं। पुराने सिस्टम में, कंप्यूटर किसी निर्णय को समझाने के लिए इनपुट से कुछ सूचनाओं को अस्थायी रूप से हटाकर प्रयास करता था, ठीक वैसे ही जैसे किसी तस्वीर के कुछ हिस्सों को ढककर यह देखना कि क्या छवि अभी भी समझ में आती है। यदि कवर किए गए हिस्से के बाद भी कंप्यूटर परिणाम का सही अनुमान लगा पाता था, तो उस हिस्से को महत्वहीन माना जाता था। हालाँकि, शोधकर्ताओं ने पाया कि ये सिस्टम अक्सर 'कवर' के विशिष्ट पैटर्न का उपयोग करना सीख जाते थे। उदाहरण के लिए, यदि किसी डेटा को महत्वहीन होने पर हमेशा शून्य (जीरो) से बदल दिया जाता था, तो कंप्यूटर यह सीख जाता था कि शून्य देखना एक विशिष्ट प्रकार की स्थिति का संकेत है, प्रभावी रूप से डेटा की अनुपस्थिति को एक गुप्त कोड के रूप में उपयोग करके अपना अनुमान लगाना। इसका मतलब था कि सिस्टम वास्तव में महत्वपूर्ण विशेषताओं की पहचान नहीं कर रहा था; वह केवल अपने ही खेल के नियमों को याद कर रहा था।

इसे ठीक करने के लिए, 'हाइड एंड सीक' टीम ने इस बात को फिर से डिजाइन किया कि कंप्यूटर गायब जानकारी को कैसे संभालता है। किसी हटाए गए फीचर को शून्य जैसे निश्चित मान से बदलने के बजाय, वे इसे उस डेटा के प्राकृतिक वितरण (डिस्ट्रीब्यूशन) से प्राप्त एक यादृच्छिक (रैंडम) मान से बदल देते हैं। कल्पना कीजिए कि एक सिस्टम घरों की कीमतों की भविष्यवाणी करने की कोशिश कर रहा है। यदि वह "बेडरूम की संख्या" वाले फीचर को हटा देता है, तो पिछले तरीके उसे शून्य से बदल सकते हैं, जो कि एक स्पष्ट संकेत है कि डेटा गायब है। हालाँकि, 'हाइड एंड सीक' इसे एक यादृच्छिक संख्या से बदल देता है जो वास्तविक जीवन में पाए जाने वाले बेडरूम की संख्या जैसा ही दिखता है। यह कंप्यूटर के लिए वास्तविक बेडरूम की संख्या और बदली गई संख्या के बीच अंतर करना असंभव बना देता है, जिससे वह केवल उन्हीं विशेषताओं पर निर्भर रहने के लिए मजबूर होता है जिन्हें उसने रखा है। यह दृष्टिकोण सिस्टम को डेटा के अंतराल का उपयोग शॉर्टकट के रूप में करने से रोकता है।

शोधकर्ताओं ने एक प्रशिक्षण रणनीति भी पेश की जो समय के साथ कंप्यूटर की प्राथमिकताओं को बदल देती है। सीखने की प्रक्रिया की शुरुआत में, सिस्टम को पूरी तरह से भविष्यवाणी को सही करने पर ध्यान केंद्रित करने के लिए कहा जाता है, भले ही वह कई विशेषताओं का उपयोग करे। जैसे-जैसे प्रशिक्षण आगे बढ़ता है, सिस्टम को धीरे-धीरे कम विशेषताओं का उपयोग करने के लिए प्रोत्साहित किया जाता है, जिससे वह अधिक कुशल और सटीक बनना सीखता है। यह दो-चरणीय दृष्टिकोण कंप्यूटर को एक खराब समाधान में फंसने से बचने में मदद करता है जहाँ वह बहुत अधिक अनावश्यक विवरणों पर निर्भर हो जाता है। परिणाम एक ऐसा मॉडल है जो अपने पूर्ववर्तियों की तुलना में न केवल प्रशिक्षित होने में तेज़ है, बल्कि निर्णय के वास्तविक कारकों की पहचान करने में भी अधिक सटीक है।

जब विभिन्न परिदृश्यों पर परीक्षण किया गया, जिनमें सिस्टम को चकमा देने के लिए डिज़ाइन किया गया सिंथेटिक डेटा से लेकर वास्तविक दुनिया के क्रेडिट कार्ड रिकॉर्ड और मेडिकल डेटा शामिल थे, 'हाइड एंड सीक' ने लगातार मौजूदा तरीकों से बेहतर प्रदर्शन किया। "स्विच" फीचर्स वाले प्रयोगों में—वे चर जो उनके मान के आधार पर खेल के नियमों को बदलते हैं, जैसे तापमान यह निर्धारित करना कि स्टोर हॉट चॉकलेट बेचेगा या आइस्ड टी—पुराने तरीके लगभग आधे समय स्विच को महत्वपूर्ण पहचानने में विफल रहे। वे गायब डेटा के पैटर्न से धोखा खा गए थे। इसके विपरीत, 'हाइड एंड सीक' ने इन महत्वपूर्ण स्विचों को लगभग हर बार सही ढंग से पहचाना। यह प्रणाली अत्यधिक सह-संबंधित (कोरिलेटेड) डेटा के साथ भी मजबूत साबित हुई, जहाँ कई चर एक साथ चलते हैं, एक ऐसी स्थिति जो अक्सर अन्य एल्गोरिदम को भ्रमित करती है। हस्तलिखित अंकों की छवियों का उपयोग करने वाले परीक्षणों में, इस पद्धति ने सफलतापूर्वक उन विशिष्ट स्ट्रोक्स को उजागर किया जो एक 'तीन' को 'आठ' से अलग करते हैं, जबकि अन्य तरीकों ने बिखरे हुए और असंगत परिणाम दिए।

इस कार्य के निहितार्थ केवल बेहतर एल्गोरिदम बनाने से कहीं अधिक हैं। यह सुनिश्चित करके कि इन प्रणालियों द्वारा दिए गए स्पष्टीकरण वास्तविक हैं और पद्धति के छिपे हुए शॉर्टकट का परिणाम नहीं हैं, 'हाइड एंड सीक' ब्लैक बॉक्स के भीतर झांकने का एक अधिक विश्वसनीय तरीका प्रदान करता है। यह चिकित्सा और वित्त जैसे क्षेत्रों के लिए महत्वपूर्ण है, जहाँ निर्णय के पीछे के "क्यों" को समझना निर्णय स्वयं जितना ही महत्वपूर्ण है। शोधकर्ताओं ने प्रदर्शित किया कि कैसे जानकारी को छिपाने के तरीके को बदलकर, वे कंप्यूटर को सिस्टम को गेम करने से रोक सकते हैं। यह मानव निर्णयकर्ताओं और उन आर्टिफिशियल इंटेलिजेंस उपकरणों के बीच अधिक ईमानदार और पारदर्शी बातचीत की अनुमति देता है जिन पर वे भरोसा करते हैं, यह सुनिश्चित करता है कि भविष्यवाणी के कारण वास्तविक डेटा पर आधारित हैं, न कि विश्लेषण के लिए उपयोग की जाने वाली पद्धति के कृत्रिम प्रभावों (आर्टिफैक्ट्स) पर।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →