← नवीनतम पेपर
🤖 machine learning

Enhancing AI Interpretability and Safety through Localised Architectures

यह शोध पत्र यह तर्क देता है कि स्केलेबल, अपारदर्शी डीप न्यूरल नेटवर्क से GPU क्लस्टर्स से हटकर कम बैंडविड्थ लेकिन उच्च प्रति-नोड अभिव्यंजना (expressivity) वाले स्थानीयकृत हार्डवेयर आर्किटेक्चर की ओर संक्रमण, विशेष रूप से छोटे डेटासेट्स के लिए, AI मॉडल्स की व्याख्यात्मकता, सुरक्षा और कम्प्यूटेशनल दक्षता को मौलिक रूप से बढ़ा सकता है।

मूल लेखक: Ian Seet, Jonas Bozenhard, Simon Osterman

प्रकाशित 2026-06-09
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Ian Seet, Jonas Bozenhard, Simon Osterman

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

यहाँ इस शोध पत्र का सरल भाषा और रोज़मर्रा के उदाहरणों के साथ विवरण दिया गया है।

बड़ी समस्या: "ब्लैक बॉक्स" वाला विशालकाय (The "Black Box" Giant)

आज के आधुनिक AI (जैसे कि आपके द्वारा उपयोग किए जाने वाले स्मार्ट चैटबॉट्स) को एक विशाल, सुपर-फास्ट लाइब्रेरी की तरह समझें। यह लाइब्रेरी विशाल कंप्यूटर चिप्स (GPUs) पर बनी है जो एक-दूसरे से अविश्वसनीय रूप से तेज़ी से बात कर सकती हैं। क्योंकि वे इतनी तेज़ी से संवाद कर सकते हैं, इसलिए यह लाइब्रेरी लगभग कुछ भी सीख सकती है, कविता लिखने से लेकर प्रोटीन के आकार का अनुमान लगाने तक।

हालाँकि, इसमें एक पेंच है। क्योंकि लाइब्रेरी में हर कोई एक ही समय में सभी के साथ बात कर रहा है, इसलिए यह पता लगाना असंभव है कि किसने क्या कहा। यदि लाइब्रेरी कोई गलत उत्तर देती है, तो कोई नहीं जानता कि किस विशिष्ट पुस्तक या बातचीत के कारण वह गलती हुई। शोध पत्र इसे "ब्लैक बॉक्स" (Black Box) कहता है। यह बहुत अच्छा काम करता है, लेकिन यह अपारदर्शी (opaque) है, इसे नियंत्रित करना कठिन है, और यह बहुत अधिक बिजली का उपयोग करता है (जैसे कि 24/7 चलने वाला एक विशाल एयर कंडीशनर)।

प्रस्तावित समाधान: "स्थानीय पड़ोस" (The "Local Neighborhood")

लेखक सुझाव देते हैं कि हमें एक विशाल, सुपर-कनेक्टेड लाइब्रेरी बनाने की कोशिश करने के बजाय कई छोटे, स्वतंत्र "स्थानीय पड़ोस" (local neighborhoods) बनाने चाहिए।

इसे इस तरह समझें:

  • वर्तमान AI (शहर): यहाँ हर कोई हाई-स्पीड फाइबर ऑप्टिक्स से जुड़ा हुआ है। जानकारी तुरंत हर जगह फैल जाती है। यह शहर को शक्तिशाली तो बनाता है, लेकिन साथ ही इसे अराजक और समझने में कठिन भी बना देता है।
  • प्रस्तावित AI (गाँव): एक ऐसे गाँव की कल्पना करें जहाँ लोग केवल अपने निकटतम पड़ोसियों से बात करते हैं। वे पूरे शहर में चिल्लाकर बात नहीं कर सकते। इस धीमी संचार की भरपाई करने के लिए, गाँव में प्रत्येक व्यक्ति अपने आप में एक "सुपर-स्मार्ट विशेषज्ञ" बन जाता है। उन्हें अपने आप में बहुत अभिव्यंजक (expressive) और सक्षम होना पड़ता है क्योंकि वे भारी काम करने के लिए समूह पर निर्भर नहीं रह सकते।

शोध पत्र का तर्क है कि यदि हम AI को इन "गाँवों" (स्थानीय आर्किटेक्चर) की तरह काम करने के लिए मजबूर करते हैं, तो यह समझना बहुत आसान हो जाता है कि वह कोई निर्णय क्यों ले रहा है। यदि कोई गलती होती है, तो आप इसे लाखों कनेक्शनों के उलझे हुए जाल के बजाय एक विशिष्ट व्यक्ति (या नोड) तक ट्रैक कर सकते हैं।

यह क्यों महत्वपूर्ण है?

  1. सुरक्षा और विश्वास: यदि आप जानते हैं कि एक मशीन कैसे सोचती है, तो यदि वह गलत करती है, तो आप उसे ठीक कर सकते हैं। वर्तमान में, यदि कोई AI झूठ बोलता है या पक्षपाती होता है, तो यह बताना कठिन है कि ऐसा क्यों हुआ या इसे कैसे रोका जाए।
  2. ऊर्जा: "शहर" वाला मॉडल उन सभी हाई-स्पीड कनेक्शनों को चालू रखने के लिए भारी मात्रा में बिजली का उपयोग करता है। "गाँव" वाला मॉडल अधिक ऊर्जा-कुशल होगा क्योंकि इसे कमरे के पार चिल्लाने की आवश्यकता नहीं होगी।

हार्डवेयर चुनौती: हम इन गाँवों को कैसे बनाएंगे?

शोध पत्र इन स्थानीय पड़ोसों के लिए "हार्डवेयर" (भौतिक मस्तिष्क) बनाने के विभिन्न तरीकों पर विचार करता है। वे चार प्रकार की सामग्रियों की तुलना करते हैं, जैसे घर के लिए अलग-अलग निर्माण सामग्री चुनना:

  1. एनालॉग इलेक्ट्रॉनिक्स (पुराना रेडियो):

    • फायदे: बहुत ऊर्जा-कुशल।
    • नुकसान: पुराने रेडियो की तरह, यह 'स्टैटिक नॉइज़' (शोर) के प्रति संवेदनशील है। सटीक उत्तर प्राप्त करना कठिन है, और यह वर्तमान सुपर-फास्ट चिप्स की तुलना में प्रति यूनिट गति के मामले में पर्याप्त "स्मार्ट" नहीं है।
  2. इलेक्ट्रोकेमिकल सिस्टम (मानव मस्तिष्क):

    • फायदे: ये हमारे वास्तविक मस्तिष्क की तरह काम करते हैं, जो रसायनों और आयनों का उपयोग करते हैं। ये बहुत अभिव्यंजक होते हैं।
    • नुकसान: ये धीमे होते हैं। साथ ही, चूंकि ये जीव विज्ञान की तरह काम करते हैं, इसलिए इन्हें समझना भी बहुत कठिन है। सिर्फ इसलिए कि हमने एक "मस्तिष्क" बनाया है, इसका मतलब यह नहीं है कि हम आसानी से उसके विचारों को पढ़ सकते हैं।
  3. शुद्ध रासायनिक सिस्टम (डिफ्यूजन सूप):

    • फायदे: रासायनिक प्रतिक्रियाओं का उपयोग करता है।
    • नुकसान: बहुत धीमा। सूचना पानी में रंग की एक बूंद के फैलने की तरह चलती है—बिजली की तुलना में बहुत सुस्त।
  4. आणविक यांत्रिक तर्क (छोटा क्लॉकवर्क):

    • सबसे प्रबल दावेदार: उन सूक्ष्म, कठोर गियरों की कल्पना करें जो गणित करने के लिए आपस में जुड़ते हैं।
    • फायदे: ये अविश्वसनीय रूप से सटीक (सिमुलेट करने में आसान), बहुत अभिव्यंजक और ऊर्जा-कुशल हैं। ये अस्त-व्यस्त रासायनिक प्रसार (diffusion) पर निर्भर नहीं हैं।
    • नुकसान: हम अभी इन्हें बना नहीं सकते। यह एक बेहतरीन स्विस घड़ी के ब्लूप्रिंट होने जैसा है, लेकिन उन सूक्ष्म गियरों को जोड़ने के लिए हमारे पास कोई उपकरण नहीं है।

निष्कर्ष

शोध पत्र यह निष्कर्ष निकालता है कि हालांकि हम वर्तमान में "शहर जैसे" AI पर निर्भर हैं क्योंकि यह शक्तिशाली और तेज़ है, लेकिन यह खतरनाक और बर्बादी भरा है। हमें "गाँव जैसे" AI आर्किटेक्चर पर शोध करना चाहिए जो संचार में धीमे लेकिन व्यक्तिगत रूप से अधिक स्मार्ट हों।

भले ही इन्हें बनाने के लिए सबसे अच्छा हार्डवेयर (छोटे आणविक गियर) अभी मौजूद नहीं है, लेकिन शक्तिशाली AI जिसे हम समझ या नियंत्रित नहीं कर सकते, उसका जोखिम इतना अधिक है कि हमें इसे आविष्कार करने की कोशिश जारी रखनी चाहिए। लक्ष्य थोड़ी सी कच्ची गति (raw speed) को बहुत अधिक सुरक्षा, स्पष्टता और ऊर्जा दक्षता के लिए बदलना है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →