← नवीनतम पेपर
🤖 machine learning

Instance-wise Linearization of Neural Network for Model Interpretation

यह शोध पत्र एक इंस्टेंस-वाइज लीनियराइजेशन (instance-wise linearization) दृष्टिकोण प्रस्तावित करता है जो अद्वितीय सक्रियण पैटर्न (unique activation patterns) के आधार पर न्यूरल नेटवर्क की गैर-रेखीय फॉरवर्ड गणना को एक एकल रैखिक मैट्रिक्स गुणन में पुनर्गठित करता है, जिससे सटीक फीचर एट्रिब्यूशन (feature attribution) प्राप्त होता है और यह स्पष्ट रूप से प्रकट होता है कि इनपुट फीचर्स सुपरवाइज्ड और अनसुपरवाइज्ड दोनों लर्निंग कार्यों में भविष्यवाणियों में कैसे योगदान देते हैं।

मूल लेखक: Zhimin Li, Shusen Liu, Kailkhura Bhavya, Peer-Timo Bremer, Valerio Pascucci

प्रकाशित 2026-09-09
📖 7 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Zhimin Li, Shusen Liu, Kailkhura Bhavya, Peer-Timo Bremer, Valerio Pascucci

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

आधुनिक दुनिया में, आर्टिफिशियल इंटेलिजेंस (कृत्रिम बुद्धिमत्ता) दैनिक जीवन में एक शांत साथी बन गया है, जो चिकित्सा निदान से लेकर ऋण अनुमोदन तक के निर्णयों का मार्गदर्शन करता है। इन प्रणालियों के केंद्र में न्यूरल नेटवर्क हैं, जो ऐसे कंप्यूटर प्रोग्राम हैं जिन्हें डेटा से पैटर्न सीखने के लिए डिज़ाइन किया गया है, ठीक वैसे ही जैसे मानव मस्तिष्क अनुभव से सीखता है। ये नेटवर्क सरल प्रसंस्करण इकाइयों की परतों से बने होते हैं जो सूचना को आगे भेजते हैं, जिससे कच्चे इनपुट को अंतिम उत्तरों में बदला जाता है। वर्षों से, ये प्रणालियाँ अविश्वसनीय रूप से प्रभावी रही हैं, फिर भी वे उन लोगों के लिए काफी हद तक रहस्यमय बनी हुई हैं जो उन पर भरोसा करते हैं। जब कोई नेटवर्क निर्णय लेता है, तो यह देखना अक्सर असंभव होता है कि कौन से सूचना के टुकड़े सबसे महत्वपूर्ण थे या सिस्टम ने उस निष्कर्ष तक पहुँचने के लिए उन्हें कैसे संयोजित किया। पारदर्शिता की इस कमी ने एक बड़ी बाधा खड़ी कर दी है, क्योंकि सरकारें और वैज्ञानिक तेजी से मांग कर रहे हैं कि इन स्वचालित प्रणालियों को महत्वपूर्ण कार्यों के भरोसे में लेने से पहले अपने तर्क को स्पष्ट करना होगा।

शोधकर्ताओं की एक टीम ने अब इस 'ब्लैक बॉक्स' से पर्दा हटाने का एक तरीका प्रस्तावित किया है, यह अनुमान लगाकर नहीं कि सिस्टम कैसे सोचता है, बल्कि समय के एक एकल क्षण के लिए इसकी विचार प्रक्रिया को गणितीय रूप से सरल बनाकर। उनका काम बताता है कि जबकि एक न्यूरल नेटवर्क समग्र रूप से देखने पर अविश्वसनीय रूप से जटिल है, किसी भी एक विशिष्ट भविष्यवाणी के लिए इसका व्यवहार वास्तव में काफी सीधा होता है। एक एकल भविष्यवाणी को एक अद्वितीय घटना मानकर, शोधकर्ताओं ने पाया कि वे नेटवर्क की गैर-रैखिक जटिलताओं को हटा सकते हैं और इसकी पूरी निर्णय लेने की प्रक्रिया को एक विशिष्ट स्थानीय क्षेत्र के भीतर एक सरल, प्रत्यक्ष गणना के रूप में फिर से लिख सकते हैं। यह दृष्टिकोण उन्हें यह देखने की अनुमति देता है कि डेटा का प्रत्येक हिस्सा अंतिम परिणाम में कैसे योगदान देता है, जिससे एक रहस्यमय एल्गोरिदम एक पारदर्शी कारण और प्रभाव के मानचित्र में बदल जाता है।

इस खोज का मूल आधार इन नेटवर्कों के संचालन के बारे में एक सरल अवलोकन पर टिका है। न्यूरल नेटवर्क विशेष घटकों का उपयोग करते हैं जिन्हें 'एक्टिवेशन यूनिट्स' कहा जाता है ताकि यह तय किया जा सके कि सिग्नल को आगे भेजना है या रोकना है। ये इकाइयाँ एक गैर-रैखिक व्यवहार बनाती हैं, जिसका अर्थ है कि इनपुट और आउटपुट के बीच का संबंध एक सीधी रेखा नहीं है, जो इस सिस्टम को इतना शक्तिशाली बनाता है लेकिन साथ ही इसे समझना भी कठिन बना देता है। हालाँकि, शोधकर्ताओं ने नोट किया कि किसी भी एकल भविष्यवाणी के लिए, नेटवर्क इन एक्टिवेशन यूनिट्स के माध्यम से केवल एक विशिष्ट पथ का अनुसरण करता है। एक बार जब वह पथ चुन लिया जाता है, तो नेटवर्क का जटिल, घुमावदार व्यवहार एक रैखिक प्रक्रिया में सिमट जाता है। इस विशिष्ट उदाहरण में, नेटवर्क अब एक जटिल, वक्रीय निर्णय नहीं ले रहा है; यह केवल इनपुट को संख्याओं के एक सेट से गुणा कर रहा है और एक स्थिर मान (constant value) जोड़ रहा है।

इसे सिद्ध करने के लिए, टीम ने एक न्यूरल नेटवर्क के माध्यम से डेटा की 'फॉरवर्ड जर्नी' को फिर से लिखने का एक तरीका विकसित किया। उन्होंने कंप्यूटर विज़न में उपयोग किए जाने वाले मानक परतों को लिया, जैसे कि वे जो किनारों या आकृतियों के लिए छवियों को स्कैन करती हैं, और दिखाया कि प्रत्येक को एक मानक मैट्रिक्स गुणन (matrix multiplication) में परिवर्तित किया जा सकता है। इसमें वे कनवल्शन परतें शामिल हैं जो छवियों को स्कैन करती हैं, पूलिंग परतें जो छवि के आकार को कम करती हैं, और यहाँ तक कि 'स्किप कनेक्शंस' भी जो गहरे नेटवर्क को बेहतर ढंग से सीखने में मदद करते हैं। हर एक परत को इस रैखिक प्रारूप में बदलकर, वे उन सभी को एक विशाल समीकरण में संयोजित कर सकते थे। परिणाम एक एकल सूत्र है जहाँ इनपुट को वेट्स (weights) के एक बड़े मैट्रिक्स से गुणा किया जाता है और एक बायस टर्म (bias term) जोड़ा जाता है ताकि आउटपुट प्राप्त हो सके। यह सूत्र उस विशिष्ट छवि के लिए नेटवर्क के निर्णय का एक सटीक प्रतिनिधित्व के रूप में कार्य करता है, जो यह प्रकट करता है कि प्रत्येक पिक्सेल ने अंतिम स्कोर में कितना योगदान दिया।

शोधकर्ताओं ने हस्तलिखित अंकों और कारों एवं जानवरों जैसी जटिल वस्तुओं की पहचान करने के लिए प्रशिक्षित कई प्रसिद्ध इमेज रिकग्निशन मॉडलों पर इस पद्धति का परीक्षण किया। उन्होंने पाया कि ये नेटवर्क निर्णय लेने के तरीके में एक आश्चर्यजनक विभाजन दिखाते हैं। बुनियादी अंक वाली छवियों के लिए प्रशिक्षित सरल मॉडलों के लिए, सूत्र का मुख्य गणना वाला हिस्सा निर्णय का लगभग सारा भार वहन करता था, जबकि स्थिर जोड़ वाला पद नगण्य था। हालाँकि, कठिन डेटासेट पर प्रशिक्षित अधिक जटिल मॉडलों के लिए, स्थिर पद (constant term) प्रमुख शक्ति बन गया। इन उन्नत नेटवर्कों में, स्थिर मान अकेले ही अक्सर भविष्यवाणी का बहुमत निर्धारित कर सकता था, जबकि इनपुट फीचर्स की विस्तृत गणना की भूमिका छोटी थी। यह खोज इस सामान्य धारणा को चुनौती देती है कि नेटवर्क की आंतरिक गणनाएँ हमेशा उसके विकल्पों का प्राथमिक चालक होती हैं, यह सुझाव देती है कि कई आधुनिक प्रणालियों के लिए, एक निश्चित बायस (fixed bias) भारी काम कर रहा है।

न्यूरल नेटवर्क को देखने का यह नया तरीका न केवल यह समझने के लिए एक शक्तिशाली उपकरण प्रदान करता है कि एक मॉडल क्या भविष्यवाणी करता है, बल्कि यह भी कि वह उस भविष्यवाणी तक कैसे पहुँचता है। क्योंकि यह विधि निर्णय को प्रत्येक इनपुट फीचर के प्रत्यक्ष योगदान में तोड़ देती है, इसलिए यह एक विस्तृत मानचित्र बना सकती है जो यह दिखाती है कि छवि के किन हिस्सों ने नेटवर्क को एक विशिष्ट लेबल के पक्ष में निर्णय लेने में मदद की और किन हिस्सों ने इसके विरुद्ध काम किया। हस्तलिखित अंकों के प्रयोगों में, शोधकर्ताओं ने दिखाया कि यह मानचित्र एक संख्या को परिभाषित करने वाले स्ट्रोक को सही ढंग से उजागर करता है, जैसे कि सात का लूप या एक की ऊर्ध्वाधर रेखा। अन्य तरीकों के विपरीत जो महत्व का अनुमान लगाते हैं, यह दृष्टिकोण उस नेटवर्क के वास्तविक गणित के आधार पर प्रत्येक पिक्सेल के योगदान की गणना करता है, बशर्ते कि नेटवर्क 'पीस-वाइज लीनियर एक्टिवेशन फंक्शन्स' का उपयोग करता हो।

इस तकनीक की उपयोगिता साधारण इमेज क्लासिफिकेशन से परे 'अनसुपरवाइज्ड लर्निंग' के क्षेत्र में भी फैली हुई है, जहाँ नेटवर्कों का उपयोग बिना मानवीय लेबल के डेटा को व्यवस्थित करने के लिए किया जाता है। शोधकर्ताओं ने अपने तरीके को 'पैरामीट्रिक t-SNE' नामक एक तकनीक पर लागू किया, जो उच्च-आयामी डेटा को मानव अवलोकन के लिए द्वि-आयामी मानचित्र में सिकोड़ने के लिए एक न्यूरल नेटवर्क का उपयोग करता है। आमतौर पर, यह समझना कठिन होता है कि नेटवर्क दो डेटा बिंदुओं को इस मानचित्र पर एक-दूसरे के करीब क्यों रखता है। अपने लीनियराइजेशन (linearization) पद्धति को लागू करके, टीम उस डेटा बिंदु की यात्रा को नेटवर्क के माध्यम से ट्रैक कर सकी और देख सकी कि किन फीचर्स के कारण वह एक विशिष्ट स्थान पर पहुँचा। उन्होंने पाया कि पास रखे गए नमूने अक्सर समान फीचर योगदान साझा करते हैं, लेकिन कभी-कभी, जो बिंदु पास दिखाई देते थे, वे वास्तव में बहुत अलग आंतरिक कारणों से संचालित थे, एक ऐसा सूक्ष्म अंतर जो पारंपरिक विश्लेषण उपकरणों के साथ अदृश्य रहता।

अंततः, यह कार्य न्यूरल नेटवर्कों को शून्य से पुनर्गठित किए बिना उन्हें समझने के लिए एक लचीला ढांचा प्रदान करता है। यह पहचानकर कि एक एकल भविष्यवाणी एक स्थानीय क्षेत्र के भीतर एक रैखिक घटना है, शोधकर्ताओं ने दिखाया है कि निर्णय प्रक्रिया को एक स्पष्ट, गणितीय कथन में पुनर्गठित किया जा सकता है। इसका मतलब यह नहीं है कि नेटवर्क सरल हैं, बल्कि यह है कि उनकी जटिलता को रोका जा सकता है और एक समय में एक कदम करके जांचा जा सकता है। चाहे लक्ष्य यह सुनिश्चित करना हो कि एआई निष्पक्ष निर्णय ले रहा है या किसी वैज्ञानिक को यह समझने में मदद करना हो कि एक मॉडल दुनिया को कैसे देखता है, यह दृष्टिकोण मशीन के तर्क में एक सीधा झरोखा प्रदान करता है, जो अटकलों के स्थान पर सटीक गणना को स्थापित करता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →