Enhancing astrometric registration of Chinese historical Astronomical Digital Plates with deep learning
यह शोध पत्र एक ट्रांसफॉर्मर-आधारित डीप लर्निंग मॉडल प्रस्तुत करता है जो चीनी ऐतिहासिक खगोलीय प्लेटों में विश्वसनीय तारकीय स्रोतों की पहचान करता है, जो सफलतापूर्वक 1,353 पूर्व में अनकैलिब्रेटेड डिजिटाइज़्ड प्लेटों के एस्ट्रोमेट्रिक पंजीकरण को सक्षम बनाता है और इस दीर्घकालिक टाइम-डोमेन डेटासेट की वैज्ञानिक उपयोगिता को बढ़ाता है।
मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें
कल्पना कीजिए कि आपके पास 1900 के दशक के पुराने, धूल भरे फोटो एल्बमों का एक विशाल पुस्तकालय है। ये केवल आपके परिवार की तस्वीरें नहीं हैं; ये रात का आकाश हैं, जिन्हें डिजिटल कैमरों के अस्तित्व में आने से पहले खगोलविदों द्वारा ग्लास प्लेटों पर कैद किया गया था। ये तस्वीरें अविश्वसनीय रूप से मूल्यवान हैं क्योंकि ये हमें दिखाती हैं कि एक सदी के दौरान तारे कैसे चले हैं।
हालाँकि, एक समस्या है: ये पुरानी तस्वीरें क्षतिग्रस्त हैं। इनमें खरोंचें, फफूंद, उंगलियों के निशान और फीके धब्बे हैं। जब वैज्ञानिक इन तस्वीरों में सितारों को खोजने के लिए कंप्यूटर का उपयोग करने की कोशिश करते हैं, तो कंप्यूटर भ्रमित हो जाता है। वह एक खरोंच को तारे के रूप में या एक धब्बे को ग्रह के रूप में समझ लेता है। इस कारण से, हजारों कीमती तस्वीरें एक "प्रोसेसिंग क्यू" (प्रतीक्षा सूची) में फंस गईं, जिनका उपयोग विज्ञान के लिए नहीं किया जा सका।
यह शोध पत्र इस बारे में है कि कैसे वैज्ञानिकों की एक टीम ने इस गड़बड़ी को सुलझाने के लिए एक सुपर-स्मार्ट डिजिटल जासूस बनाया।
समस्या: "भ्रमित रोबोट"
पहले, वैज्ञानिक सितारों को खोजने के लिए एक मानक कंप्यूटर प्रोग्राम (जैसे कि एक बुनियादी स्पेल-चेकर) का उपयोग करते थे। यह साफ तस्वीरों पर ठीक काम करता था, लेकिन जब तस्वीरें गंदी या खरोंच वाली होती थीं, तो प्रोग्राम घबरा जाता था। वह कहता था, "क्या यह एक तारा है? या यह एक खरोंच है?" और अक्सर गलत निर्णय लेता था। यदि कंप्यूटर सुनिश्चित नहीं हो पाता था, तो वह पूरी तस्वीर को ही खारिज कर देता था।
समाधान: "AI जासूस" (Swin Transformer)
शोधकर्ताओं ने कंप्यूटर के मस्तिष्क को अपग्रेड करने का निर्णय लिया। एक बुनियादी स्पेल-चेकर का उपयोग करने के बजाय, उन्होंने एक डीप लर्निंग AI (विशेष रूप से एक मॉडल जिसे Swin Transformer कहा जाता है) को फोटो के छोटे टुकड़ों, जिन्हें "कटआउट" कहा जाता है, को देखने के लिए प्रशिक्षित किया।
इसे इस तरह समझें:
- पुराना तरीका: आप एक रोबोट से एक अस्त-व्यस्त कमरे में लाल गेंद खोजने के लिए कहते हैं। यदि उसे एक लाल मोजा दिखता है, तो वह चिल्लाता है "बॉल!" और भ्रमित हो जाता है।
- नया तरीका: आप रोबोट को वस्तु की बनावट (texture) और आकार (shape) को देखना सिखाते हैं। वह सीख जाता है कि एक तारा एक नरम, चमकते हुए धुंधले प्रकाश (जैसे कि एक कॉटन बॉल) जैसा दिखता है, जबकि एक खरोंच एक तेज, टेढ़ी-मेढ़ी रेखा (जैसे कि टूटे हुए कांच का टुकड़ा) जैसी दिखती है। भले ही फोटो गंदी हो, AI अंतर कर सकता है।
उन्होंने AI को कैसे प्रशिक्षित किया
इस AI को सिखाने के लिए, उन्होंने केवल रैंडम तस्वीरें उस पर नहीं फेंकीं। उन्होंने एक "शिक्षक-छात्र" (Teacher-Student) दृष्टिकोण का उपयोग किया:
- बेस मॉडल (एक सामान्य विशेषज्ञ): सबसे पहले, उन्होंने AI को हजारों बिल्कुल साफ तस्वीरें दिखाईं जहाँ उन्हें पहले से पता था कि कौन से बिंदु तारे हैं और कौन सी खरोंचें हैं। AI ने एक तारे के दिखने के सामान्य नियमों को सीखा।
- फाइन-ट्यूनिंग (एक विशिष्ट विशेषज्ञ): उन्होंने महसूस किया कि कुछ तस्वीरें इतनी अजीब तरह से क्षतिग्रस्त थीं कि सामान्य विशेषज्ञ AI भी भ्रमित हो जाता था। इसलिए, उन विशिष्ट कठिन तस्वीरों के लिए, उन्होंने AI के "विशेषज्ञ" संस्करण बनाए। उन्होंने इन विशेषज्ञों को समान टेलीस्कोप या समान प्रकार की क्षति वाले उदाहरण दिखाकर सिखाया। यह एक स्थानीय गाइड को काम पर रखने जैसा है जो जानता है कि उस विशेष इलाके में गंदगी कैसी दिखती है।
परिणाम: इतिहास को बचाना
परिणाम जादू की तरह थे:
- उन्होंने 1,883 तस्वीरें लीं जिन्हें पहले "ठीक करने में असमर्थ" माना गया था।
- उनके नए AI सिस्टम ने वास्तविक सितारों की पहचान सफलतापूर्वक की और खरोंच/धूल को अनदेखा कर दिया।
- वे उन 1,353 तस्वीरों पर सितारों की स्थिति को सफलतापूर्वक मैप करने में सक्षम रहे।
इसका मतलब है कि उन्होंने उन 1,300 से अधिक ऐतिहासिक तस्वीरों के वैज्ञानिक मूल्य को अनलॉक कर दिया जो अन्यथा अंधेरे में ही रह जातीं।
यह क्यों मायने रखता है?
कल्पना कीजिए कि आप 100 वर्षों में एक धीरे चलने वाले कछुए को ट्रैक करने की कोशिश कर रहे हैं। यदि आपके पास केवल 50% तस्वीरें हैं, तो आप उसकी पूरी यात्रा नहीं देख सकते। लेकिन अब, इन 1,353 नए "अनलॉक" किए गए फोटो के साथ, खगोलविदों के पास एक बहुत स्पष्ट, लंबी समयरेखा है। वे अध्ययन कर सकते हैं कि तारे कैसे चलते हैं, ब्रह्मांड कैसे फैलता है, और हमारा सौर मंडल कैसे बदलता है, और यह सब एक ऐसे कंप्यूटर की बदौलत संभव हुआ है जिसने गंदगी को अनदेखा करना और सितारों को देखना सीख लिया है।
संक्षेप में: उन्होंने एक कंप्यूटर को इंसान से बेहतर जासूस बनना सिखाया, जिससे वे हजारों क्षतिग्रस्त ऐतिहासिक तस्वीरों को बचाने और उन्हें ब्रह्मांड को समझने के लिए शक्तिशाली उपकरणों में बदलने में सक्षम हुए।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।