← नवीनतम पेपर
💻 computer science

Photonic Quantum-Enhanced Knowledge Distillation

यह शोध पत्र फोटोनिक क्वांटम-एन्हांस्ड नॉलेज डिस्टिलेशन (PQKD) को प्रस्तुत करता है, जो एक हाइब्रिड फ्रेमवर्क है जो एक पैरामीटर-कुशल स्टूडेंट नेटवर्क के लिए कंडीशनिंग सिग्नल उत्पन्न करने हेतु फोटोनिक क्वांटम प्रोसेसर की अंतर्निहित स्टोकेस्टिसिटी (stochasticity) का लाभ उठाता है, जो शॉट-नॉइज़ स्केलिंग और फीचर स्मूथिंग का उपयोग करके परिमित सैंपलिंग सीमाओं को प्रबंधित करते हुए मानक बेंचमार्क पर आक्रामक संपीड़न (compression) के तहत प्रतिस्पर्धी सटीकता प्राप्त करता है।

मूल लेखक: Kuan-Cheng Chen, Shang Yu, Chen-Yu Liu, Samuel Yen-Chi Chen, Huan-Hsin Tseng, Yen Jui Chang, Wei-Hao Huang, Felix Burt, Esperanza Cuenca Gomez, Zohim Chandani, William Clements, Ian Walmsley, Kin K. L
प्रकाशित 2026-09-08
📖 7 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Kuan-Cheng Chen, Shang Yu, Chen-Yu Liu, Samuel Yen-Chi Chen, Huan-Hsin Tseng, Yen Jui Chang, Wei-Hao Huang, Felix Burt, Esperanza Cuenca Gomez, Zohim Chandani, William Clements, Ian Walmsley, Kin K. Leung

मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

आधुनिक दुनिया में, आर्टिफिशियल इंटेलिजेंस एक शक्तिशाली उपकरण बन गया है, लेकिन इसके साथ एक भारी कीमत भी आती है: इन प्रणालियों को चलाने के लिए अक्सर भारी मात्रा में कंप्यूटर मेमोरी और ऊर्जा की आवश्यकता होती है। इन्हें रोजमर्रा के उपकरणों पर उपयोगी बनाने के लिए, वैज्ञानिक लंबे समय से इन्हें छोटा करने का प्रयास कर रहे हैं, जिसे मॉडल कंप्रेशन (model compression) कहा जाता है। इसे करने का सबसे प्रभावी तरीकों में से एक 'नॉलेज डिस्टिलेशन' (knowledge distillation) है। एक अत्यंत बुद्धिमान, उच्च प्रशिक्षित शिक्षक की कल्पना करें जो किसी विषय के बारे में सब कुछ जानता है, और एक छोटा, उत्साही छात्र जिसे वही सामग्री सीखने की आवश्यकता है। केवल सही उत्तरों को रटने के बजाय, छात्र शिक्षक की विचार प्रक्रिया को देखकर और शिक्षक द्वारा देखे जाने वाले सूक्ष्म पैटर्न और संबंधों को आत्मसात करके सीखते हैं। यह छात्र को अपने विशाल आकार की आवश्यकता के बिना आश्चर्यजनक रूप से सक्षम बनाता है। इसी समय, विज्ञान का एक अलग क्षेत्र यह पता लगाने की खोज कर रहा है कि गणना करने के लिए बिजली के बजाय प्रकाश का उपयोग कैसे किया जाए। प्रकाश-आधारित कंप्यूटर, या फोटोनिक प्रोसेसर (photonic processors), में एक अनूठी विशेषता होती है: जब वे प्रकाश को मापते हैं, तो परिणाम स्वाभाविक रूप से यादृच्छिक (random) होते हैं, ठीक वैसे ही जैसे पासा फेंकना। यह यादृच्छिकता कोई दोष नहीं है बल्कि एक विशेषता है जिसका उपयोग जटिल पैटर्न उत्पन्न करने के लिए किया जा सकता है।

शोधकर्ताओं की एक टीम ने अब इन दोनों विचारों को एक साथ जोड़ दिया है, जिससे 'फोटोनिक क्वांटम-एनहैंस्ड नॉलेज डिस्टिलेशन' (Photonic Quantum-Enhanced Knowledge Distillation) नामक एक नई विधि बनाई है। उन्होंने एक प्रणाली बनाई जहाँ एक छोटा, प्रकाश-आधारित कंप्यूटर एक छोटे आर्टिफिशियल इंटेलिजेंस मॉडल के प्रशिक्षण के दौरान एक विशेष सहायक के रूप में कार्य करता है। इस सेटअप में, एक बड़ा, शक्तिशाली "शिक्षक" नेटवर्क एक बहुत छोटे "छात्र" नेटवर्क का मार्गदर्शन करता है। मोड़ यह है कि छात्र केवल शिक्षक के उत्तरों से ही नहीं सीखता; बल्कि उसे फोटोनिक प्रोसेसर द्वारा उत्पन्न एक अद्वितीय, निरंतर बदलते संकेत भी प्राप्त होता है। यह प्रकाश-आधारित उपकरण प्रकाश का एक निश्चित इनपुट लेता है, इसे दर्पणों और फेज़ शिफ्टर्स (phase shifters) के एक प्रोग्राम करने योग्य सर्किट से गुजारता है, और फिर आउटपुट को मापता है। क्योंकि माप की प्रक्रिया स्वाभाविक रूप से शोर भरी और यादृच्छिक होती है, इसलिए यह एक समृद्ध, संरचित संकेत उत्पन्न करता है जिसका उपयोग छात्र अपनी आंतरिक जानकारी को मिलाने के निर्णय के लिए करता है। शोधकर्ताओं ने पाया कि यह दृष्टिकोण छात्र को उसके सामान्य आकार के एक अंश तक संकुचित करने की अनुमति देता है, जबकि वह मूल शिक्षक के लगभग समान प्रदर्शन करता है।

शोधकर्ताओं ने तीन अलग-अलग दृश्य डेटा सेटों पर इस पद्धति का परीक्षण किया: हस्तलिखित अंक, कपड़ों की छवियां, और रोजमर्रा की वस्तुओं की छोटी तस्वीरें। प्रत्येक मामले में, उन्होंने छात्र नेटवर्क के भीतर के मानक, भारी गणितीय परतों को एक बहुत हल्के संस्करण से बदल दिया। प्रत्येक फ़िल्टर में हर एक संख्या को शून्य से सीखने के बजाय, छात्र ने बुनियादी आकृतियों के एक छोटे समूह को सीखा। फिर फोटोनिक प्रोसेसर ने एक गतिशील संकेत प्रदान किया जिसने छात्र को बताया कि वह प्रत्येक विशिष्ट छवि के लिए इन बुनियादी आकृतियों को कैसे संयोजित करे। इसका अर्थ यह था कि छात्र को केवल कुछ बुनियादी पैटर्न और उन्हें मिलाने का तरीका सीखना था, न कि लाखों व्यक्तिगत संख्याओं को याद करना था। परिणाम स्वरूप, एक मॉडल प्राप्त हुआ जो काफी छोटा था लेकिन फिर भी अत्यधिक सटीक बना रहा। हस्तलिखित संख्याओं को पहचानने जैसे सरल कार्यों पर, संकुचित छात्र विशाल शिक्षक के लगभग समान प्रदर्शन करता है, भले ही छात्र को मूल आकार के एक बहुत छोटे हिस्से तक कम कर दिया गया हो।

इस खोज का एक प्रमुख हिस्सा यह समझना था कि सिस्टम प्रकाश-आधारित हार्डवेयर की स्वाभाविक यादृच्छिकता को कैसे संभालता है। चूंकि फोटोनिक प्रोसेसर प्रकाश के व्यक्तिगत कणों को गिनने पर निर्भर करता है, इसलिए जब भी इसे संकेत उत्पन्न करने के लिए कहा जाता है, तो परिणाम थोड़ा उतार-चढ़ाव वाला हो सकता है, जिसे 'शॉट नॉइज़' (shot noise) नामक घटना कहा जाता है। शोधकर्ताओं ने देखा कि यदि वे बहुत कम माप का उपयोग करते हैं, तो छात्र का प्रदर्शन गिर जाएगा। हालांकि, उन्होंने पाया कि समय के साथ संकेतों का औसत निकालकर, वे इन उतार-चढ़ाव को सुचारू बना सकते हैं। इसने सिस्टम को सीमित माप के साथ भी विश्वसनीय रूप से काम करने में सक्षम बनाया, जिससे यह सिद्ध हुआ कि यह पद्धति वास्तविक दुनिया के हार्डवेयर के लिए पर्याप्त मजबूत है जो अभी तक पूर्ण, शोर-मुक्त गणना करने में सक्षम नहीं है।

अध्ययन ने यह भी पता लगाया कि इस संपीड़न (compression) को कितनी दूर तक ले जाया जा सकता है। जब शोधकर्ताओं ने छात्र नेटवर्क की केवल पहली परत पर यह तकनीक लागू की, तो प्रदर्शन उत्कृष्ट बना रहा। जब उन्होंने इसे पहली दो परतों पर लागू किया, तब भी सिस्टम अच्छा बना रहा। अंत में, उन्होंने परतों के पूरे स्टैक को संकुचित किया, जिससे कुछ मामलों में प्रशिक्षित मापदंडों (parameters) की संख्या सौ गुना से अधिक कम हो गई। इस अत्यधिक स्तर के संपीड़न के बावजूद, छात्र नेटवर्क विफल नहीं हुआ। यह सीखना जारी रखता है और एक समाधान पर अभिसरित (converge) होता है, जिससे सटीकता का एक स्थिर स्तर बना रहता है जो मूल शिक्षक से केवल थोड़ा कम है। यह सुझाव देता है कि शिक्षक के मार्गदर्शन और प्रकाश-जनित संकेत का संयोजन सीखने के लिए एक बहुत मजबूत आधार बनाता है, जिससे छात्र को बहुत कम स्वतंत्रता (degrees of freedom) होने पर भी अच्छे समाधान खोजने में मदद मिलती है।

शोधकर्ताओं ने कई डेटासेट और विभिन्न आकार के शिक्षक नेटवर्कों में अपने निष्कर्षों को मान्य किया। उन्होंने पाया कि यह प्रणाली एक स्पष्ट ट्रेड-ऑफ (trade-off) बनाती है: जैसे-जैसे मॉडल छोटा होता जाता है, सटीकता गिरती है, लेकिन यह गिरावट अनुमानित और नियंत्रणीय होती है। यह निर्धारित करके कि छात्र कितनी बुनियादी आकृतियाँ सीखता है और फोटोनिक प्रोसेसर को कितना "बजट" दिया जाता है, वे आकार और प्रदर्शन के बीच सर्वोत्तम संतुलन खोजने के लिए सिस्टम को ट्यून कर सकते थे। यह कार्य प्रदर्शित करता है कि प्रकाश-आधारित क्वांटम हार्डवेयर कुशल आर्टिफिशियल इंटेलिजेंस को प्रशिक्षित करने के लिए एक व्यावहारिक उपकरण के रूप में कार्य कर सकता है, पूरे कंप्यूटर को बदलने के बजाय, केवल सीखने के चरण के दौरान एक विशेष सिग्नल जनरेटर के रूप में। प्रशिक्षण पूरा होने के बाद, अंतिम छात्र मॉडल पूरी तरह से मानक, क्लासिकल कंप्यूटरों पर चलता है, जिसका अर्थ है कि जटिल प्रकाश-आधारित हार्डवेयर की आवश्यकता केवल मॉडल बनाने के लिए होती है, उसे उपयोग करने के लिए नहीं।

यह दृष्टिकोण आर्टिफिशियल इंटेलिजेंस को अधिक कुशल बनाने के लिए एक नया मार्ग प्रदान करता है। यह दिखाता है कि क्वांटम प्रकाश की अंतर्निहित यादृच्छिकता, जिसे अक्सर एक बाधा के रूप में देखा जाता है, को प्रशिक्षण के लिए एक उपयोगी संसाधन में बदला जा सकता है। इस पद्धति के लिए यह आवश्यक नहीं है कि अंतिम AI को महंगे या नाजुक क्वांटम मशीनों पर चलना पड़े; इसे केवल निर्माण प्रक्रिया के दौरान उनकी आवश्यकता होती है। परिणाम बताते हैं कि जैसे-जैसे फोटोनिक हार्डवेयर में सुधार होगा, यह तकनीक और भी शक्तिशाली और सघन AI सिस्टम बनाने की अनुमति दे सकती है, जो सीमित संसाधनों वाले उपकरणों पर चलने में सक्षम होंगे। यह अध्ययन एक ब्लूप्रिंट प्रदान करता है कि उभरती हुई इन तकनीकों को मुख्यधारा के मशीन लर्निंग में कैसे एकीकृत किया जाए, जो क्वांटम कंप्यूटिंग की सैद्धांतिक क्षमता और आधुनिक आर्टिफिशियल इंटेलिजेंस की व्यावहारिक आवश्यकताओं के बीच के अंतर को पाटता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →