← नवीनतम पेपर
🤖 machine learning

Sparse Covariance Neural Networks

यह शोध पत्र स्पार्स कोवेरियेंस न्यूरल नेटवर्क्स (S-VNNs) को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो स्पार्स और डेंस दोनों डेटा व्यवस्थाओं में स्प्यूरियस सहसंबंधों (spurious correlations) को कम करने के लिए सैंपल कोवेरियेंस मैट्रिक्स पर अनुकूलित स्पारसिफिकेशन तकनीकों को लागू करके पारंपरिक कोवेरियेंस न्यूरल नेटवर्क्स के प्रदर्शन, स्थिरता और गणनात्मक दक्षता को बढ़ाता है।

मूल लेखक: Andrea Cavallo, Zhan Gao, Elvin Isufi

प्रकाशित 2026-08-04
📖 7 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Andrea Cavallo, Zhan Gao, Elvin Isufi

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक जटिल सामाजिक नेटवर्क को समझने की कोशिश कर रहे हैं, जैसे कि एक हाई स्कूल कैफेटेरिया। आप जानना चाहते हैं कि कौन किसके साथ समय बिताता है। यदि आप कमरे की एक त्वरित झलक लेते हैं, तो आप दो लोगों को एक साथ खड़े देख सकते हैं और मान सकते हैं कि वे सबसे अच्छे दोस्त हैं। लेकिन हो सकता है कि वे बस संयोग से एक ही समय पर लंच करने आए हों। डेटा साइंस की दुनिया में, इसे "स्पूरियस कोरिलेशन" (spurious correlation) कहा जाता है—एक नकली संबंध जो असली दिखता है लेकिन वास्तव में नहीं है। वैज्ञानिक इन कनेक्शनों को मैप करने के लिए "कोवेरिएंस न्यूरल नेटवर्क्स" (Covariance Neural Networks) नामक उपकरणों का उपयोग करते हैं। इन नेटवर्क्स को एक विशाल स्प्रेडशीट के रूप में सोचें, जहाँ हर कॉलम एक व्यक्ति है और हर नंबर यह दिखाता है कि वे एक-दूसरे के साथ कितना "वाइब" (vibe) करते हैं। यह नेटवर्क इन वाइब्स को एक मानचित्र की तरह मानता है, और उन लोगों के बीच रेखाएं खींचता है जो जुड़े हुए प्रतीत होते हैं। यह शेयर बाजार के रुझानों की भविष्यवाणी करने या मस्तिष्क के विभिन्न हिस्सों के बीच संचार को समझने के लिए बहुत उपयोगी है। हालाँकि, इसमें एक पेंच है: जब आपके पास पर्याप्त डेटा नहीं होता (जैसे कैफेटेरिया की केवल कुछ ही झलकियाँ), तो मानचित्र नकली रेखाओं से भर जाता है। यह अव्यवस्थित, पढ़ने में धीमा और समझने में कठिन हो जाता है, और जासूस गलतियाँ करने लगता है।

यह शोध पत्र एक नए, स्मार्ट जासूस से परिचय कराता है जिसे स्पार्स कोवेरिएंस न्यूरल नेटवर्क्स (S-VNNs) कहा जाता है। लेखकों, एंड्रिया कैवलो, झान गाओ और एल्विन इसुफी ने महसूस किया कि पुराने मानचित्र उन नकली कनेक्शनों से बहुत अधिक भरे हुए थे। उनका समाधान? एक "प्रूनिंग" (pruning - छंटाई) टूल। उन्होंने यह पता लगाया कि जासूस के काम शुरू करने से पहले मानचित्र से कमजोर, संभावित रूप से नकली रेखाओं को कैसे हटाया जाए। उन्होंने इसे करने के दो मुख्य तरीकों का परीक्षण किया। पहला, यदि उन्हें पता था कि वास्तविक दुनिया वास्तव में सरल थी (केवल कुछ वास्तविक कनेक्शन थे), तो उन्होंने शोर को हटाने के लिए एक "हार्ड कट" या "सॉफ्ट ट्रिम" का उपयोग किया। दूसरा, यदि वास्तविक दुनिया अव्यवस्थित थी और कनेक्शनों से भरी हुई थी, तो उन्होंने संयोग के खेल का उपयोग किया, जो कि दिखने में मजबूत रेखाओं के आधार पर रेखाओं को बेतरतीब ढंग से गिराने जैसा था, ठीक वैसे ही जैसे यह देखने के लिए "ड्रॉप द बॉल" का डिजिटल संस्करण हो कि क्या टिकता है। परिणाम एक ऐसा सिस्टम है जो न केवल तेज़ और सस्ता है, बल्कि अधिक विश्वसनीय भी है। यह शोर से भ्रमित नहीं होता है, और यह डेटा के स्पार्स (कम कनेक्शन) या डेंस (अधिक कनेक्शन) होने पर भी बेहतर काम करता है।

समस्या: शोर वाला मानचित्र

कल्पना कीजिए कि आप यातायात के एक ही दिन के आधार पर अपने शहर का नक्शा बनाने की कोशिश कर रहे हैं। यदि आप देखते हैं कि दो कारें एक ही लाल बत्ती पर रुकी हैं, तो आप उनके घरों को जोड़ने वाली एक सड़क बना सकते हैं। लेकिन शायद वे सिर्फ लाइट के लिए रुकी थीं! यदि आप ऐसा हर कार के लिए करते हैं, तो आपका नक्शा नकली सड़कों का एक उलझा हुआ जाल बन जाएगा। यह बिल्कुल वही है जो मानक कोवेरिएंस न्यूरल नेटवर्क्स (VNNs) के साथ होता है। वे डेटा देखते हैं और उन सभी वेरिएबल्स के बीच रेखाएं खींचते हैं जो आपस में संबंधित लगते हैं। लेकिन क्योंकि वे सीमित नमूनों (जैसे यातायात के उस एक दिन) पर निर्भर करते हैं, वे अक्सर ऐसी रेखाएं खींच देते हैं जो वास्तव में वहां नहीं हैं। ये "स्पूरियस कोरिलेशन" नेटवर्क को धीमा और त्रुटियों के प्रति संवेदनशील बनाते हैं। यह एक ऐसे शहर में नेविगेट करने जैसा है जहाँ हर संभावित सड़क खींची गई है, भले ही वे अस्तित्व में न हों।

समाधान: प्रूनिंग शीर्स (छंटाई की कैंची)

लेखक स्पार्स कोवेरिएंस न्यूरल नेटवर्क्स (S-VNNs) का प्रस्ताव करते हैं। इसे जासूस को प्रूनिंग शीर्स (छंटाई की कैंची) देने के रूप में सोचें। नेटवर्क द्वारा मानचित्र से सीखने से पहले, S-VNNs कमजोर, संदिग्ध रेखाओं को काट देता है। शोध पत्र इन शीर्स का उपयोग करने के दो अलग-अलग परिदृश्यों की खोज करता है:

  1. जब सच्चाई सरल हो (स्पार्स कोवेरिएंस): कभी-कभी, वास्तविक दुनिया वास्तव में सरल होती है। हो सकता है कि केवल कुछ मस्तिष्क क्षेत्र वास्तव में जुड़े हों, या केवल कुछ शेयर एक साथ चलते हों। इस मामले में, लेखक हार्ड थ्रेशोल्डिंग (Hard Thresholding) या सॉफ्ट थ्रेशोल्डिंग (Soft Thresholding) का उपयोग करने का सुझाव देते हैं।

    • हार्ड थ्रेशोल्डिंग एक सख्त बाउंसर की तरह है। यदि कोई कनेक्शन एक विशिष्ट संख्या से कमजोर है, तो उसे तुरंत बाहर निकाल दिया जाता है। जब वास्तविक मानचित्र सरल होता है, तो यह शोर को हटाने में बहुत प्रभावी होता है।
    • सॉफ्ट थ्रेशोल्डिंग थोड़ा सौम्य है। यह केवल कमजोर रेखाओं को बाहर नहीं करता है; यह थोड़ी मजबूत रेखाओं को भी थोड़ा सिकोड़ देता है ताकि वे अधिक विश्वसनीय बन सकें। यह उस डेटा के लिए बेहतरीन है जिसमें बहुत सारे शोर के बीच कुछ मजबूत संकेत मौजूद हैं।
  2. जब सच्चाई जटिल हो (डेंस कोवेरिएंस): कभी-कभी, वास्तविक दुनिया अव्यवस्थित होती है, और लगभग सब कुछ किसी न किसी चीज़ से जुड़ा होता है। यहाँ, आप सब कुछ काट नहीं सकते, अन्यथा आप असली कहानी खो देंगे। इसके बजाय, लेखक स्टोकेस्टिक स्पारसिफिकेशन (Stochastic Sparsification) का प्रस्ताव करते हैं। यह संयोग के खेल जैसा है। आप प्रत्येक कनेक्शन की ताकत देखते हैं और संभावना के आधार पर तय करते हैं कि उसे रखना है या छोड़ना है। यदि कोई कनेक्शन बहुत मजबूत है, तो उसकी मौजूदगी लगभग निश्चित है। यदि वह कमजोर है, तो उसके जाने की संभावना अधिक है। यह विधि नेटवर्क को जटिल डेटा को संभालने की अनुमति देती है बिना अभिभूत हुए, जो अन्य AI मॉडलों में "ड्रॉपआउट" की तरह काम करता है, जिससे सिस्टम अधिक मजबूत तरीके से सीख पाता है।

उन्होंने क्या पाया

शोधकर्ताओं ने केवल अनुमान नहीं लगाया; उन्होंने आंकड़े चलाए। उन्होंने अपने नए S-VNNs का परीक्षण कृत्रिम डेटा और वास्तविक दुनिया के डेटासेट, जिसमें अल्जाइमर के रोगियों के मस्तिष्क स्कैन और विभिन्न शारीरिक गतिविधियों (जैसे चलने या दौड़ने) के रिकॉर्ड शामिल थे, दोनों पर किया।

  • स्थिरता (Stability): सबसे बड़ी जीत स्थिरता है। जब डेटा के नमूने कम होते हैं, तो पुराने VNNs डगमगा जाते हैं और बड़ी गलतियाँ करते हैं। हालाँकि, नए S-VNNs स्थिर रहते हैं। उन्होंने गणितीय रूप से सिद्ध किया कि नकली रेखाओं को हटाकर, नेटवर्क का आउटपुट डेटा अपूर्ण होने पर भी उतना अधिक नहीं हिलता है। यह एक ऐसे GPS की तरह है जो सिग्नल कमजोर होने पर घबराता नहीं है।
  • गति (Speed): क्योंकि वे कई रेखाओं को काट देते हैं, इसलिए S-VNNs बहुत तेज़ हैं। शोध पत्र नोट करता है कि बड़े डेटासेट के लिए, डेटा को प्रोसेस करने में लगने वाला समय काफी कम हो जाता है। यह एक शब्दकोश पढ़ने बनाम एक सारांश पढ़ने के अंतर जैसा है।
  • प्रदर्शन (Performance): आश्चर्यजनक रूप से, रेखाओं को काटने से परिणामों को नुकसान नहीं पहुँचा; बल्कि इससे मदद मिली। मानव क्रियाओं को पहचानने या मस्तिष्क स्कैन से उम्र का अनुमान लगाने जैसे कार्यों पर, S-VNNs अक्सर मूल, भीड़भाड़ वाले नेटवर्क्स की तुलना में बेहतर प्रदर्शन करते हैं। यह सुझाव देता है कि पुराना नेटवर्क जिस "शोर" को सीखने की कोशिश कर रहा था, वह वास्तव में उसके प्रदर्शन को नुकसान पहुँचा रहा था।

निष्कर्ष

यह शोध पत्र सुझाव देता है कि कभी-कभी, कम ही अधिक होता है। डेटा मानचित्र से "नकली दोस्तों" को जानबूझकर हटाकर, AI वास्तविक कनेक्शनों पर ध्यान केंद्रित कर सकता है। लेखक दिखाते हैं कि चाहे वास्तविक दुनिया सरल हो या जटिल, एक स्पारसिफिकेशन रणनीति मौजूद है जो नेटवर्क को तेज़, अधिक स्थिर और अक्सर अधिक स्मार्ट बनाती है। उन्होंने केवल इसे तेज़ करने का तरीका नहीं खोजा; उन्होंने यह भी खोजा कि डेटा कम होने पर AI को अधिक विश्वसनीय कैसे बनाया जाए, जो वास्तविक दुनिया के अनुप्रयोगों के लिए एक बड़ी बात है जहाँ पूर्ण डेटा एकत्र करना असंभव है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →