EPIC-CIM: Training Convolutional Neural Networks on a Coherent Ising Machine via Equilibrium Propagation
यह शोध पत्र EPIC-CIM को प्रस्तुत करता है, जो एक ऐसा ढांचा है जो इक्विलिब्रियम प्रोपेगेशन (equilibrium propagation) का उपयोग करके एक एनर्जी-बेस्ड मॉडल को अनुकूलित कर कोहेरेंट आइसिंग मशीनों पर क्वांटम कनवल्शनल न्यूरल नेटवर्क के प्रशिक्षण को सक्षम बनाता है, जिससे स्पष्ट ग्रेडिएंट बैकप्रोपैगेशन पर निर्भर किए बिना गैर-विभेदक (non-differentiable) क्वांटम ऑपरेशन्स और असतत अवस्था विकास (discrete state evolution) की अंतर्निहित चुनौतियों पर विजय प्राप्त की जा सकती है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि आप एक रोबोट को फोटो में बिल्ली पहचानना सिखाने की कोशिश कर रहे हैं। क्लासिकल कंप्यूटरों की दुनिया में, हम आमतौर पर रोबोट को लाखों तस्वीरें दिखाकर और एक गणितीय "बैकप्रोपैगेशन" (backpropagation) ट्रिक का उपयोग करके ऐसा करते हैं। बैकप्रोपैगेशन को एक ऐसे शिक्षक के रूप में सोचें जो भूलभुलैया में पीछे की ओर चलते हुए, रोबोट द्वारा की गई हर गलत मोड़ की ओर इशारा करता है और उसे बताता है कि उसे अपने कदमों को कैसे समायोजित करना चाहिए ताकि वह निकास के करीब पहुँच सके। यह चिकने, निरंतर रास्तों के लिए बहुत अच्छा काम करता है। लेकिन क्या होगा अगर आपका रोबोट एक ऐसी दुनिया में रहता है जो स्विचों से बनी है जो केवल "ऑन" या "ऑफ" हो सकते हैं, जैसे कि एक विशाल, जटिल लाइट बोर्ड? इस दुनिया में, कोई चिकके रास्ते नहीं हैं जिन पर पीछे की ओर चला जा सके; यहाँ केवल तीखी, ऊबड़-खाबड़ चट्टानें हैं। आप एक स्विच को धीरे से नहीं थपथपा सकते; आपको उसे फ्लिप करना ही होगा। यह पारंपरिक "शिक्षक" पद्धति को बेकार बना देता है।
यही वह पहेली है जिसका सामना क्वांटम मशीन लर्निंग का नया क्षेत्र कर रहा है। क्वांटम कंप्यूटर अद्भुत हैं, लेकिन वे अक्सर इन "ऑन/ऑफ" स्विचों (जिन्हें बाइनरी स्टेट्स कहा जाता है) पर काम करते हैं और उनमें ऐसी माप (measurements) शामिल होती हैं जो हमारे द्वारा उपयोग किए जाने वाले सहज गणित को तोड़ देती हैं। वैज्ञानिक इन क्वांटम दिमागों को प्रशिक्षित करने के लिए संघर्ष करते रहे हैं क्योंकि उनके सामान्य उपकरण इसमें फिट नहीं बैठते। उन्हें एक नए तरीके की आवश्यकता थी जिससे रोबोट को सिखाया जा सके जो ग्रेडिएंट (gradient) पर निर्भर न हो, बल्कि प्राकृतिक भौतिकी के नियमों का उपयोग करे—विशेष रूप से, इस विचार का कि सिस्टम हमेशा अपनी सबसे कम ऊर्जा वाली स्थिति में स्थिर होना चाहता है, जैसे कि एक गेंद पहाड़ी के निचले हिस्से की ओर लुढ़कती है। यह शोध पत्र इस अंतर में कदम रखता है, और पूछता है: क्या हम एक क्वांटम न्यूरल नेटवर्क को एक भौतिक प्रणाली के रूप में प्रशिक्षित कर सकते हैं जो अपने सबसे आरामदायक विश्राम स्थल को खोजने की कोशिश कर रही है, बजाय इसके कि वह एक छात्र की तरह कैलकुलस की समस्या हल करने की कोशिश करे?
क्वांटम दिमागों को सिखाने का नया तरीका
इस अध्ययन के पीछे के शोधकर्ताओं ने, सन यत-सेन यूनिवर्सिटी और QBoson क्वांटम टेक्नोलॉजी की एक टीम के साथ मिलकर, एक नया प्रशिक्षण ढांचा बनाया है जिसे EPIC-CIM कहा जाता है। इसे "ऊबड़-खाबड़ चट्टान" की समस्या के एक चतुर समाधान के रूप में समझें। एक ऐसे ढलान को खोजने की कोशिश करने के बजाय जो मौजूद ही नहीं है, वे सिस्टम को स्वाभाविक रूप से संतुलन, या "इक्विलिब्रियम" (equilibrium) की स्थिति में बैठने देते हैं, और सीखने के लिए दो थोड़े अलग संतुलनों के बीच के अंतर का उपयोग करते हैं।
यहाँ उनका तरीका, EPIC-CIM, एक खेलपूर्ण उपमा का उपयोग करते हुए बताया गया है:
कल्पना कीजिए कि हजारों लाइट स्विचों से भरा एक विशाल, अराजक कमरा है (ये क्वांटम मशीन के "बाइनरी स्टेट्स" हैं)। आपका लक्ष्य इन स्विचों को इस तरह व्यवस्थित करना है कि जब आप उन्हें देखें तो वे "CAT" शब्द बनाएं।
- सेटअप: आप कमरे में एक टॉर्च (इनपुट इमेज) जलाते हैं। रोशनी स्विचों से टकराती है, उन्हें चालू या बंद होने के लिए प्रेरित करती है।
- "फ्री" चरण: पहले, आप कमरे को अपने आप स्थिर होने देते हैं। स्विच हिलते और पलटते हैं जब तक कि वे प्रकाश के आधार पर एक आरामदायक पैटर्न न ढूंढ लें। यह "फ्री फेज" है। सिस्टम बस आराम कर रहा है, अपने प्राकृतिक ऊर्जा स्तर को खोज रहा है।
- "नज" (Nudge) चरण: अब, आप चाहते हैं कि कमरा "CAT" लिखे। इसलिए, आप उन स्विचों को धीरे से धकेलते हैं जिन्हें "CAT" के लिए चालू रहना चाहिए, और उन्हें जो नहीं होने चाहिए उन्हें बंद रहने के लिए। आप उन्हें मजबूर नहीं करते; आप बस उन्हें एक छोटा सा, हल्का धक्का (एक "वीकली क्लैम्प्ड" अवस्था) देते हैं और फिर से स्थिर होने देते हैं।
- सीखना: जादू दो कमरों की तुलना करने से होता है। शोधकर्ता "फ्री" कमरे और "नज" कमरे के बीच के अंतर को देखते हैं। यदि आपके धक्के के कारण एक स्विच अलग तरह से बदला, तो वह सिस्टम को बताता है, "हे, तुम्हें अपनी सेटिंग्स को बदलने की जरूरत है ताकि वह स्विच चालू रहे जब मैं इसे कहूँ!" वे बिना कभी जटिल ग्रेडिएंट की गणना किए, इस अंतर के आधार पर नियमों (नेटवर्क के "वेट्स") को अपडेट करते हैं।
इस प्रक्रिया को इक्विलिब्रियम प्रोपेगेशन (Equilibrium Propagation) कहा जाता है। यह एक कुत्ते को गेंद के भौतिकी समझाने के बजाय, उसे बैठने पर पुरस्कृत करने और गलत होने पर धीरे से सुधारने जैसा है, जिससे कुत्ता दोहराव और फीडबैक के माध्यम से पैटर्न को समझ जाता है।
उन्होंने क्या पाया
टीम ने इस नए "इक्विलिब्रियम प्रोपेगेशन" तरीके का परीक्षण तीन प्रसिद्ध इमेज डेटासेट पर किया: MNIST (हाथ से लिखे अंक), Fashion-MNIST (कपड़े), और CIFAR-10 (रंगीन रोजमर्रा की वस्तुएं)। उन्होंने अपने EPIC-CIM मॉडल की तुलना अन्य क्वांटम विधियों से की, जिनमें "वेरिएशनल क्वांटम सर्किट्स" (जो रेडियो को स्क्रूड्राइवर से ट्यून करने जैसा है) और "क्वांटम एनीलिंग" (जो एक गेंद को पहाड़ी से नीचे लुढ़काकर नीचे का हिस्सा खोजने जैसा है) शामिल हैं।
परिणाम काफी उत्साहजनक थे:
- MNIST डेटासेट पर: EPIC-CIM ने 92.32% की टेस्ट सटीकता प्राप्त की। यह मानक क्वांटम कनवोल्यूशनल न्यूरल नेटवर्क (QCNN) से काफी बेहतर था, जिसने 84.59% स्कोर किया, और क्वांटम एनीलिंग दृष्टिकोण से भी बेहतर था, जिसने 87.53% हासिल किया।
- Fashion-MNIST डेटासेट पर: नई विधि ने 79.62% स्कोर किया, जो QCNN (78.29%) और क्वांटम एनीलिंग विधि (78.96%) दोनों को पीछे छोड़ दिया।
- कठिन CIFAR-10 डेटासेट पर: जटिल, रंगीन छवियों के बावजूद, EPIC-CIM ने 34.56% सटीकता प्राप्त की। हालांकि यह एक मानक क्लासिकल कंप्यूटर (जिसे 40.22% मिला) की तुलना में कम है, फिर भी यह अन्य क्वांटम मॉडलों की तुलना में स्पष्ट सुधार था, जो 27.79% से ऊपर उठने के लिए संघर्ष कर रहे थे।
सबसे दिलचस्प निष्कर्षों में से एक यह था कि मॉडल ने "छोटे डेटा" को कितनी अच्छी तरह संभाला। आमतौर पर, AI को सीखने के लिए लाखों तस्वीरों की आवश्यकता होती है। लेकिन EPIC-CIM ने दिखाया कि यह केवल कुछ हजार नमूनों के साथ भी प्रभावी ढंग से सीख सकता है। जब उन्होंने केवल 1,000 ट्रेनिंग इमेज के साथ इसका परीक्षण किया, तब भी यह अच्छी तरह से सीख सका, और जैसे-जैसे उन्होंने अधिक डेटा (60,000 तक) जोड़ा, इसकी सटीकता लगातार बढ़कर 92.32% हो गई। यह सुझाव देता है कि यह विधि बहुत कुशल है और आसानी से भ्रमित नहीं होती है।
क्या यह वास्तविक मशीनों पर काम करता है?
शोधकर्ताओं ने केवल कंप्यूटर सिमुलेशन तक ही सीमित नहीं रहे। उन्होंने अपने विचार का परीक्षण वास्तविक क्वांटम हार्डवेयर पर भी किया। वास्तविक क्वांटम कंप्यूटर शोर वाले होते हैं और अक्सर उच्च-परिशुद्धता (high-precision) संख्याओं को नहीं संभाल सकते; उन्हें कभी-कभी कम परिशुद्धता (जैसे मानक 32-बिट के बजाय 14-बिट संख्याएं) के साथ काम करना पड़ता है।
इन हार्डवेयर सीमाओं और वास्तविक दुनिया के "शोर" के बावजूद, EPIC-CIM मॉडल उल्लेखनीय रूप से मजबूत रहा। वास्तविक हार्डवेयर पर, इसने 91% की टेस्ट सटीकता प्राप्त की। यह उस 92.32% के बहुत करीब है जो इसे आदर्श सिमुलेशन में मिला था। यह सुझाव देता है कि यह विधि सुदृढ़ है और जब हार्डवेयर परफेक्ट नहीं होता है, तब भी यह विफल नहीं होती है।
इसका क्या अर्थ है
यह शोध पत्र सुझाव देता है कि न्यूरल नेटवर्क प्रशिक्षण को ऊर्जा संतुलन खोजने की एक भौतिक प्रक्रिया मानकर, हम क्वांटम कंप्यूटरों को प्रशिक्षित करने के गणितीय सिरदर्द से बच सकते हैं। लेखक तर्क देते हैं कि यह दृष्टिकोण प्रशिक्षण प्रक्रिया को अधिक स्थिर और व्याख्या योग्य बनाता है। गणित के ब्लैक बॉक्स के बजाय, हमारे पास एक ऐसा सिस्टम है जो एक भौतिक वस्तु की तरह अपनी जगह पर स्थिर होता है।
हालांकि मॉडल अभी भी एक क्लासिकल कंप्यूटर जितना सटीक नहीं है (विशेष रूप से CIFAR-10 जैसे कठिन कार्यों पर), यह दिखाता है कि क्वांटम-प्रेरित अनुकूलन (optimization) एक शक्तिशाली उपकरण हो सकता है। यह साबित करता है कि हम बैकप्रोपैगेशन के असंभव गणित की आवश्यकता के बिना जटिल क्वांटम नेटवर्क को प्रशिक्षित कर सकते हैं, जो भविष्य में अधिक स्थिर और स्केलेबल क्वांटम आर्टिफिशियल इंटेलिजेंस के द्वार खोलता है। शोधकर्ता निष्कर्ष निकालते हैं कि यह ढांचा क्वांटम कंप्यूटिंग और उस आर्टिफिशियल इंटेलिजेंस के बीच के अंतर को पाटने का एक एकीकृत तरीका प्रदान करता है जिसे हम रोजमर्रा में उपयोग करते हैं।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।