← नवीनतम पेपर
🔬 optics

Beyond the Thin-Layer Limit: Differentiable Volumetric Training for Visible-Range Diffractive Neural Networks

यह शोध पत्र एक डिफरेंशिएबल बीम-प्रोपैगेशन प्रशिक्षण विधि प्रस्तुत करता है जो विवर्तनिक परतों को परिमित-मोटाई वाले आयतनों के रूप में मॉडल करता है, जो दृश्य-सीमा वाले विवर्तनिक न्यूरल नेटवर्क को उच्च-सटीकता और निर्माण-संगत बनाने के लिए पतली-परत सन्निकटन की सीमाओं को दूर करता है।

मूल लेखक: Dineth Jayakody, Dushan N. Wadduwage

प्रकाशित 2026-06-09
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Dineth Jayakody, Dushan N. Wadduwage

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कल्पना कीजिए कि आप एक सुपर-फास्ट, प्रकाश की गति से चलने वाला कंप्यूटर बनाने की कोशिश कर रहे हैं जो बिजली का उपयोग नहीं करता, बल्कि समस्याओं को हल करने के लिए, जैसे चेहरे पहचानने या छवियों को छाँटने के लिए, प्रकाश की किरणों का उपयोग करता है। इस तकनीक को डिफ्रैक्टिव डीप न्यूरल नेटवर्क (D2NN) कहा जाता है। इसे पारदर्शी, पैटर्न वाली कांच की परतों के ढेर के रूप में समझें। जब प्रकाश इन परतों से होकर गुजरता है, तो वे प्रकाश को बहुत विशिष्ट तरीकों से मोड़ती और घुमाती हैं ताकि कैमरा तक पहुँचने से पहले ही उत्तर की "गणना" की जा सके।

लंबे समय तक, वैज्ञानिक इन प्रकाश-कंप्यूटरों को टेराहर्ट्ज़ तरंगों (एक प्रकार का प्रकाश जिसकी तरंग दैर्ध्य लंबी होती है, जैसे रेडियो तरंगें) का उपयोग करके बना सकते थे। इन्हें बनाना आसान था क्योंकि इनके "न्यूरॉन्स" (कांच पर बने छोटे पैटर्न) बहुत बड़े थे—लगभग रेत के एक कण के आकार के। आप उन्हें आसानी से 3D प्रिंट कर सकते थे।

हालाँकि, दृश्य प्रकाश (वह रंग जो हम देखते हैं) के लिए वास्तविक दुनिया के कैमरों और हमारी आँखों के अनुकूल काम करने के लिए, कांच पर बने पैटर्न सूक्ष्म होने चाहिए—हजारों गुना छोटे। यहीं से समस्या शुरू हुई।

समस्या: "फ्लैट मैप" की गलती

वर्षों तक, वैज्ञानिकों ने इन दृश्य-प्रकाश कंप्यूटरों को एक शॉर्टकट का उपयोग करके डिजाइन किया। उन्होंने कांच की प्रत्येक परत के साथ ऐसा व्यवहार किया जैसे कि वह अनंत रूप से पतली हो, जैसे कि कागज का एक टुकड़ा या एक सपाट मानचित्र (flat map)।

  • उपमा: कल्पना कीजिए कि आप एक 2D कागज के मानचित्र का उपयोग करके शहर में रास्ता खोजने की कोशिश कर रहे हैं। यह एक सपाट शहर के लिए बहुत अच्छा काम करता है। लेकिन यदि आप उसी सपाट मानचित्र का उपयोग करके गगनचुंबी इमारतों वाले शहर में रास्ता खोजने की कोशिश करते हैं, तो आप खो जाएंगे। मानचित्र इमारतों की ऊंचाई का हिसाब नहीं रखता है।
  • वास्तविकता: दृश्य-प्रकाश कंप्यूटरों में उपयोग की जाने वाली सामग्रियां इतनी घनी नहीं होती हैं कि वे प्रकाश को तुरंत मोड़ सकें। प्रकाश को सही मात्रा में मोड़ने के लिए, कांच पर बने "पैटर्न" को वास्तव में मोटा (जैसे एक छोटी पहाड़ी या 3D मूर्ति) होने की आवश्यकता होती है।
  • विफलता: जब वैज्ञानिकों ने इन प्रणालियों को "पतली परत" (flat map) विधि का उपयोग करके डिजाइन किया, तो उनके सिमुलेशन में कंप्यूटर पूरी तरह से काम करता था। लेकिन जब उन्होंने वास्तविक, मोटी 3D संरचनाएं बनाईं, तो प्रकाश "पहाड़ियों" के अंदर भ्रमित हो गया और कंप्यूटर छवियों को पहचानने में विफल रहा। डिजाइन वास्तविकता से मेल नहीं खा रहा था।

समाधान: "3D ब्लूप्रिंट"

इस शोध पत्र के लेखकों, जयकोडी और वडडूवेज ने महसूस किया कि समस्या प्रकाश के आकार की नहीं, बल्कि परतों की मोटाई की थी। उन्होंने एक नई प्रशिक्षण पद्धति पेश की जिसे डिफरेंशिएबल वॉल्यूमेट्रिक ट्रेनिंग (𝜉BPM) कहा जाता है।

  • उपमा: एक सपाट कागज के मानचित्र के बजाय, उन्होंने एक 3D आर्किटेक्चरल ब्लूप्रिंट का उपयोग करना शुरू किया। उन्होंने कंप्यूटर को कांच की मोटाई के भीतर यात्रा करने वाले प्रकाश को "देखना" सिखाया, न कि केवल सतह से टकराकर वापस आने वाले प्रकाश को।
  • यह कैसे काम करता है: उन्होंने एक डिजिटल मॉडल बनाया जहाँ कंप्यूटर का प्रत्येक स्तर सामग्री का एक ठोस ब्लॉक है। प्रशिक्षण प्रक्रिया के दौरान, कंप्यूटर इस ब्लॉक के माध्यम से यात्रा करने वाले प्रकाश का अनुकरण करता है, यह गणना करते हुए कि प्रकाश कैसे धीमा होता है और "पहाड़ियों" के माध्यम से चलते समय कैसे मुड़ता है।
  • जादू: क्योंकि यह 3D मॉडल "डिफरेंशिएबल" (गणितीय रूप से सुचारू) है, कंप्यूटर मानक लर्निंग ट्रिक्स का उपयोग करके 3D पहाड़ियों के आकार को स्वचालित रूप से समायोजित कर सकता है। यह प्रकाश को निर्देशित करने के लिए एकदम सही 3D आकार बनाना सीखता है, जिससे यह सुनिश्चित होता है कि जो डिज़ाइन किया गया है वह बिल्कुल वैसा ही है जैसा बनाया जा सकता है।

परिणाम: 50% से 90% तक

टीम ने प्रसिद्ध इमेज डेटासेट्स (जैसे हस्तलिखित अंक और फैशन आइटम) पर इस नई पद्धति का परीक्षण किया।

  1. पुराना तरीका (फ्लैट मैप): जब उन्होंने पुराने "पतले" तरीके का उपयोग करके एक कंप्यूटर को प्रशिक्षित किया और फिर उसे वास्तविक, मोटी 3D संरचना पर टेस्ट किया, तो वह केवल 50% बार सही उत्तर दे पाया। वह मूल रूप से केवल अनुमान लगा रहा था।
  2. नया तरीका (3D ब्लूप्रिंट): जब उन्होंने अपनी नई "वॉल्यूमेट्रिक" प्रशिक्षण पद्धति का उपयोग किया, तो सटीकता उछलकर 90% हो गई।
  3. प्रमाण: पूरी तरह से आश्वस्त होने के लिए, उन्होंने अंतिम डिजाइनों को एक अत्यंत सटीक भौतिक सिम्युलेटर (जिसे FDTD कहा जाता है जो विद्युत चुंबकत्व के मौलिक नियमों को हल करता है) के माध्यम से चलाया। नए डिजाइन अभी भी पूरी तरह से काम कर रहे थे, जिससे यह सिद्ध हुआ कि "3D ब्लूप्रिंट" दृष्टिकोण भौतिक रूप से वास्तविक और विश्वसनीय डिजाइन बनाता है।

यह क्यों महत्वपूर्ण है

यह शोध पत्र एक बड़ी बाधा को हल करता है। यह बताता है कि दृश्य-प्रकाश ऑप्टिकल कंप्यूटर बनाना इतना कठिन क्यों रहा है: हम 2D मानचित्रों का उपयोग करके 3D पहाड़ों को डिजाइन करने की कोशिश कर रहे थे। सामग्रियों की मोटाई का सम्मान करने वाली पद्धति में स्विच करके, लेखकों ने कुशल कंप्यूटर डिजाइन और इन उपकरणों को बनाने की भौतिक वास्तविकता के बीच एक सेतु बना दिया है।

इसका अर्थ है कि हम प्रकाश की गति से छवियों को देखने और संसाधित करने वाले अल्ट्रा-फास्ट, कम ऊर्जा खपत वाले ऑप्टिकल कंप्यूटरों के एक कदम और करीब हैं, जो बिल्कुल हमारी आंखों की तरह काम कर सकते हैं।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →