← नवीनतम पेपर
💻 computer science

SimGrowNet: Efficient Neural Growth with Similarity-Based Redundancy Control

सिमग्रोनैट (SimGrowNet) मानव न्यूरोजेनेसिस से प्रेरित एक कुशल न्यूरल ग्रोथ विधि है जो प्रशिक्षण के दौरान संकुचित मॉडलों का प्रगतिशील रूप से विस्तार करती है और समानता-आधारित बाधाओं के माध्यम से न्यूरॉन की अतिरेकता को न्यूनतम करती है, जिससे फीचर विविधता बढ़ती है, शॉर्टकट लर्निंग कम होती है और कई इमेज रिकग्निशन डेटासेट्स पर मौजूदा बेसलाइन्स से बेहतर प्रदर्शन होता है।

मूल लेखक: Taigo Sakai, Kazuhiro Hotta

प्रकाशित 2026-08-24
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Taigo Sakai, Kazuhiro Hotta

मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

आर्टिफिशियल इंटेलिजेंस की दुनिया में, कंप्यूटर डिजिटल कनेक्शनों के विशाल नेटवर्क बनाकर दुनिया को पहचानना सीखते हैं, जो मानव मस्तिष्क द्वारा सूचनाओं को संसाधित करने के तरीके की नकल करता है। ये सिस्टम, जिन्हें 'डीप न्यूरल नेटवर्क' कहा जाता है, तस्वीरों में वस्तुओं की पहचान करने जैसे कार्यों में अविश्वसनीय रूप से कुशल हो गए हैं। हालाँकि, उन्हें और अधिक स्मार्ट बनाने के लिए, शोधकर्ता अक्सर बस उन्हें बड़ा करते जाते हैं, और अधिक से अधिक कनेक्शन जोड़ते जाते हैं जब तक कि सिस्टम एक विशाल, ऊर्जा-खपत करने वाली मशीन नहीं बन जाता जिसे प्रशिक्षित करने में लंबा समय लगता है। यह दृष्टिकोण एक महत्वपूर्ण नुकसान रखता है: जैसे-जैसे नेटवर्क बढ़ता है, यह अक्सर खुद को दोहराने लगता है। जिस तरह श्रमिकों की एक टीम अक्षम हो सकती है यदि प्रत्येक को बिल्कुल एक ही कार्य सौंपा जाए, ये डिजिटल नेटवर्क भी ऐसे अनावश्यक हिस्सों को विकसित कर सकते हैं जहाँ कई कनेक्शन एक ही सरल विवरणों, जैसे कि आकाश के रंग, को पहचानने के लिए सीख जाते हैं, बजाय इसके कि वे वस्तु के जटिल आकार को पहचानें। यह दोहराव कंप्यूटिंग शक्ति को बर्बाद करता है और गलत संकेतों पर ध्यान केंद्रित करके सिस्टम से गलतियाँ करवा सकता है।

जापान के मेइजो यूनिवर्सिटी के शोधकर्ताओं ने इन बुद्धिमान प्रणालियों को बनाने का एक अलग तरीका प्रस्तावित किया है, जो एक स्थिर मशीन के बजाय एक जीवित जीव की तरह बढ़ता है। एक विशाल नेटवर्क से शुरू करने और उसे काटने, या बिना किसी योजना के नए हिस्से जोड़ने के बजाय, उन्होंने 'सिमग्रोननेट' (SimGrowNet) नामक एक विधि विकसित की है जो छोटे से शुरू होती है और सावधानीपूर्वक विस्तार करती है। इसका मूल विचार इस बात से प्रेरित है कि मानव मस्तिष्क वयस्कता के दौरान भी कैसे नए न्यूरॉन्स बनाना जारी रखता है। शोधकर्ताओं ने महसूस किया कि जब एक डिजिटल नेटवर्क में नए कनेक्शन जोड़े जाते हैं, तो वे अक्सर पुराने वाले के समान ही काम करते हैं। इसे ठीक करने के लिए, उन्होंने एक नियम पेश किया जो हर नए कनेक्शन को पहले से मौजूद कनेक्शनों से अलग होने के लिए मजबूर करता है। उन्होंने यह नए हिस्सों की पुराने हिस्सों के साथ समानता को मापकर और उन्हें अलग बनने के लिए धीरे से प्रेरित करके किया, जिससे यह सुनिश्चित हुआ कि नेटवर्क विविध विशेषताओं को सीखे न कि केवल कुछ ही चीजों को दोहराए।

टीम ने तीन अलग-अलग इमेज सेट पर इस दृष्टिकोण का परीक्षण किया, जिसमें साधारण जानवरों के रेखाचित्रों से लेकर वास्तविक दुनिया के दृश्यों की जटिल तस्वीरें शामिल थीं। उन्होंने अपनी नई विधि की तुलना पुरानी तकनीकों से की जो या तो यादृच्छिक (रैंडम) नए कनेक्शन जोड़ती थीं या मौजूदा कनेक्शनों की नकल करती थीं। परिणामों ने दिखाया कि नए हिस्सों को अद्वितीय बनाए रखकर, नेटवर्क अपने काम में बहुत बेहतर हो गया। छवियों की एक सौ अलग-अलग श्रेणियों को पहचानने के एक मानक परीक्षण पर, नई विधि ने पिछले सर्वश्रेष्ठ दृष्टिकोण की तुलना में सटीकता में लगभग दो प्रतिशत का सुधार किया। एक हजार श्रेणियों वाले दूसरे परीक्षण में भी इसने प्रतिस्पर्धा को पीछे छोड़ दिया। ये संख्याएँ छोटी लग सकती हैं, लेकिन आर्टिफिशियल इंटेलिजेंस के क्षेत्र में, एक अंश भी यह तय करने में अंतर ला सकता है कि कोई सिस्टम उपयोगी है या नहीं। अधिक महत्वपूर्ण बात यह है कि शोधकर्ता देख सके कि यह क्यों काम करता है। एक विज़ुअलाइज़ेशन टूल का उपयोग करके, जो यह उजागर करता है कि कंप्यूटर किस ओर देख रहा है, उन्होंने पाया कि नया तरीका पूरे ऑब्जेक्ट, जैसे कि पक्षी के शरीर और सिर पर ध्यान केंद्रित करता है, बजाय इसके कि वह बैकग्राउंड या केवल एक छोटे किनारे से विचलित हो जाए।

ध्यान का यह बदलाव यह सुझाव देता है कि नेटवर्क अब शॉर्टकट नहीं ले रहा था। कई मामलों में, पुराने तरीके एक एकल, आसान सुराग के आधार पर उत्तर का अनुमान लगाना सीख जाते थे, जैसे यह मान लेना कि पक्षी की तस्वीर वास्तव में एक हवाई जहाज है क्योंकि दोनों के बैकग्राउंड में नीला आकाश है। नए तरीके ने, कनेक्शनों को विविध बनाने के लिए मजबूर करके, सिस्टम को इन सरल ट्रिक्स पर निर्भर रहने से रोका। इसने पूरी तस्वीर को देखना सीखा। शोधकर्ताओं ने यह भी पाया कि यह लाभ केवल अधिक हिस्से जोड़ने से नहीं, बल्कि उन हिस्सों को नियंत्रित करने के तरीके से आया। यहाँ तक कि जब उन्होंने नए कनेक्शन जोड़ना बंद कर दिया और केवल एक निश्चित नेटवर्क पर नियम लागू किया, तब भी सिस्टम बेहतर प्रदर्शन करता रहा। यह इंगित करता है कि सफलता की कुंजी केवल अधिक क्षमता होना नहीं था, बल्कि एक ऐसा नेटवर्क था जहाँ हर हिस्से की एक अनूठी भूमिका थी।

इस अध्ययन ने इन प्रणालियों को प्रशिक्षित करने की एक आम समस्या को भी संबोधित किया: अस्थिरता। जब एक नेटवर्क अपनी संरचना को तेजी से बदलता है, तो यह कभी-कभी भ्रमित हो सकता है या जो ज्ञान उसने पहले से सीखा है उसे खो सकता है। शोधकर्ताओं ने अपने तरीके में एक सुरक्षा तंत्र जोड़ा जिसने नए कनेक्शनों को बहुत अधिक तेजी से बदलने से रोका, जिससे यह सुनिश्चित हुआ कि विकास के दौरान सिस्टम स्थिर रहे। उन्होंने पाया कि इन परिवर्तनों का समय महत्वपूर्ण था; नेटवर्क को बहुत बार या बहुत धीरे बढ़ने से लाभ कम हो सकता था, इसलिए उन्हें एक विशिष्ट लय ढूंढनी पड़ी जो प्रत्येक प्रकार की छवि के लिए सबसे अच्छा काम करती थी। हालांकि इस विधि को सही ढंग से करने के लिए कुछ सावधानीपूर्वक ट्यूनिंग की आवश्यकता होती है, लेकिन परिणाम बताते हैं कि कुशल, स्मार्ट नेटवर्क बनाने के लिए विशाल पैमाने की आवश्यकता नहीं है। इसके बजाय, इसमें विविधता और गुणवत्ता पर ध्यान केंद्रित करने की आवश्यकता है।

यह कार्य शक्तिशाली और कुशल आर्टिफिशियल इंटेलिजेंस बनाने के लिए एक आशाजनक मार्ग प्रदान करता है। दोहराव से बचने के तरीके से बढ़ते हुए, ये सिस्टम आज के सबसे बड़े मॉडलों से जुड़ी भारी ऊर्जा लागत के बिना उच्च प्रदर्शन प्राप्त कर सकते हैं। शोधकर्ताओं का सुझाव है कि यह दृष्टिकोण विशेष रूप से सीमित शक्ति वाले उपकरणों, जैसे स्मार्टफोन या सेंसर के लिए उपयोगी हो सकता है, जहाँ कंप्यूटिंग शक्ति का हर अंश मायने रखता है। हालांकि इस पद्धति का परीक्षण इमेज रिकग्निशन पर किया गया था, लेकिन सीखने में विविधता सुनिश्चित करने का सिद्धांत अन्य क्षेत्रों में भी लागू किया जा सकता है जहाँ कंप्यूटर को जटिल पैटर्न को समझने की आवश्यकता होती है। अध्ययन यह निष्कर्ष निकालता है कि कुशल आर्टिफिशियल इंटेलिजेंस का भविष्य केवल बड़ा बनाने में नहीं, बल्कि स्मार्ट रूप से बढ़ने में है, यह सुनिश्चित करते हुए कि सिस्टम का प्रत्येक नया हिस्सा कुछ अनूठा लेकर आए।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →