← नवीनतम पेपर
⚛️ high-energy experiments

Self-Supervised Learning for Robust Resonance Mass Regression in Cascade Decays

यह शोध पत्र विकरेग (VICReg) और ट्रांसफार्मर एनकोडर्स का उपयोग करते हुए दूषित डेटा पर मॉडलों को प्री-ट्रेन करने के लिए एक सेल्फ-सुपरवाइज्ड लर्निंग फ्रेमवर्क प्रस्तावित करता है, जो यह प्रदर्शित करता है कि यह दृष्टिकोण पारंपरिक सुपरवाइज्ड ट्रेनिंग की तुलना में जटिल कैस्केड डिके (cascade decays) में अधिक सुदृढ़ और सटीक हेवी रेजोनेंस मास रिकंस्ट्रक्शन प्रदान करता है।

मूल लेखक: Ho Fung Tsoi, Alex Yang, Luis Felipe Gutierrez Zagazeta, Shion Chen, Dylan Rankin

प्रकाशित 2026-09-17
📖 5 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Ho Fung Tsoi, Alex Yang, Luis Felipe Gutierrez Zagazeta, Shion Chen, Dylan Rankin

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

उन विशाल, उच्च-गति वाले प्रयोगशालाओं में जहाँ भौतिक विज्ञानी ब्रह्मांड को समझने के लिए कणों को आपस में टकराते हैं, अंतिम लक्ष्य अक्सर ऐसी किसी चीज़ को खोजना होता है जिसका अस्तित्व नहीं होना चाहिए। लार्ज हैड्रॉन कोलाइडर जैसी सुविधाओं पर किए जाने वाले ये प्रयोग, अनिवार्य रूप से विशाल, अत्यंत संवेदनशील कैमरे हैं जिन्हें टकराव के क्षणिक मलबे को पकड़ने के लिए डिज़ाइन किया गया है। जब दो कण लगभग प्रकाश की गति से टकराते हैं, तो वे क्षण भर के लिए एक भारी, अस्थिर कण बना सकते हैं जो तुरंत छोटे, हल्के टुकड़ों के फुहार में टूट जाता है। इन टुकड़ों की ऊर्जा और दिशा को मापकर, वैज्ञानिक मूल, अदृश्य कण के द्रव्यमान (mass) की गणना करने के लिए पीछे की ओर गणना कर सकते हैं। यह गणना नए भौतिकी (new physics) को पहचानने की कुंजी है, लेकिन यह एक नाजुक प्रक्रिया है। वे डिटेक्टर जो इन टकरावों को रिकॉर्ड करते हैं, पूर्ण नहीं होते; वे कभी-कभी पहेली के हिस्सों को चूक जाते हैं, किसी टुकड़े की ऊर्जा की गलत गणना करते हैं, या एक प्रकार के कण को दूसरे के साथ भ्रमित कर देते हैं। ये छोटी त्रुटियां, जिन्हें व्यवस्थित अनिश्चितताएं (systematic uncertainties) कहा जाता है, अंतिम चित्र को धुंधला कर सकती हैं, जिससे नए भौतिकी का एक स्पष्ट, विशिष्ट संकेत एक अस्पष्ट, अपरिचित धब्बे में बदल जाता है।

पेन्सिलवेनिया विश्वविद्यालय और क्योटो विश्वविद्यालय के शोधकर्ताओं की एक टीम ने इस चित्र को और स्पष्ट करने का एक नया तरीका विकसित किया है, भले ही डेटा अव्यवस्थित हो। उन्होंने एक विशिष्ट चुनौती का सामना किया: एक भारी, काल्पनिक कण के द्रव्यमान को सटीक रूप से कैसे मापा जाए जो ग्यारह अलग-अलग टुकड़ों के जटिल बादल में टूट जाता है, जिनमें से कुछ का पता लगाने में पूरी तरह से विफल रहता है। अतीत में, वैज्ञानिक इन मापों को करने के लिए लेबल किए गए उदाहरणों पर प्रशिक्षित कंप्यूटर मॉडल पर भरोसा करते थे। हालाँकि, ये मॉडल वास्तविक दुनिया की खामियों का सामना करने में अक्सर विफल रहते हैं क्योंकि उन्होंने प्रशिक्षण के दौरान केवल "पूर्ण" डेटा देखा होता है। इसे हल करने के लिए, शोधकर्ताओं ने 'सेल्फ-सुपरवाइज्ड लर्निंग' (self-supervised learning) नामक तकनीक का सहारा लिया। कंप्यूटर को सही उत्तर दिखाकर सिखाने के बजाय, उन्होंने इसे उसी घटना के हजारों दूषित (corrupted) संस्करणों के संपर्क में लाकर डेटा की अंतर्निहित संरचना को पहचानना सिखाया। कंप्यूटर ने शोर को अनदेखा करना और मुख्य पैटर्न पर ध्यान केंद्रित करना सीखा, जिससे वह विरूपण (distortion) के पार देखने में एक विशेषज्ञ बन गया।

शोधकर्ताओं ने अपने तरीके का परीक्षण एक सिम्युलेटेड डेटासेट पर किया जो 2.5 से 6.5 ट्रिलियन इलेक्ट्रॉन वोल्ट की सीमा वाले द्रव्यमान वाले एक भारी कण का प्रतिनिधित्व करता था, जो वर्तमान में ज्ञात किसी भी कण की तुलना में बहुत भारी पैमाना है। इस कण की कल्पना एक कैस्केड (cascade) में होने वाले क्षय के रूप में की गई थी, जो एक ग्लूऑन (gluon), आठ हल्के क्वार्क्स, एक आवेशित लेप्टॉन और एक न्यूट्रिनो में टूट जाता है, जो डिटेक्टर से बाहर निकल जाता है और केवल लुप्त ऊर्जा (missing energy) के रूप में दर्ज किया जाता है। अपने AI को तैयार करने के लिए, टीम ने पहले लाखों टकराव घटनाओं को बिना यह बताए कि मूल कण का द्रव्यमान क्या है, इसमें फीड किया। इस चरण के दौरान, उन्होंने जानबूझकर डेटा में वास्तविक त्रुटियां डालीं, जो उन प्रकार की गलतियों की नकल करती हैं जो वास्तविक डिटेक्टर करते हैं। उन्होंने यादृच्छिक रूप से कुछ कणों को हटाया, अन्य की मापी गई ऊर्जा को बदला, कोणों को धुंधला किया, और यहाँ तक कि कणों की पहचान को भी बदल दिया ताकि यह देखा जा सके कि क्या AI अभी भी उस घटना को एक संपूर्ण इकाई के रूप में पहचान सकता है। लक्ष्य यह था कि AI को इन घटनाओं का एक ऐसा मानसिक मानचित्र बनाने के लिए मजबूर किया जाए जो विरूपण के बावजूद स्थिर रहे।

एक बार जब AI ने डेटा को देखने का यह मजबूत, भ्रष्टाचार-प्रतिरोधी तरीका सीख लिया, तो शोधकर्ताओं ने द्रव्यमान रिग्रेशन (mass regression) के वास्तविक कार्य को करने के लिए इसे थोड़े से लेबल किए गए डेटा के साथ फाइन-ट्यून किया। उन्होंने इस नए दृष्टिकोण की तुलना उसी दूषित डेटा पर शून्य से प्रशिक्षित पारंपरिक मॉडल से की। परिणामों ने स्पष्ट लाभ दिखाया। जबकि दोनों मॉडल कण के औसत द्रव्यमान की भविष्यवाणी कर सकते थे, नए मॉडल ने बहुत अधिक स्पष्ट और सटीक माप प्रदान किया। कण भौतिकी की दुनिया में, एक स्पष्ट माप का अर्थ है डेटा में एक संकीर्ण शिखर (narrower peak), जो नए भौतिकी के खोज को बैकग्राउंड शोर से अलग करना काफी आसान बनाता है। नया मॉडल डेटा के अत्यधिक विकृत होने पर भी इस सटीकता को बनाए रखता है, जबकि पारंपरिक मॉडल का प्रदर्शन त्रुटियों के बढ़ने के साथ कम हो जाता है।

अध्ययन ने प्रदर्शित किया कि शोर को अनदेखा करना सीखने से पहले उत्तर सीखना सीखकर, AI द्रव्यमान के पुनर्निर्माण को एक ऐसे रेजोल्यूशन के साथ कर सकता था जो सभी परीक्षण किए गए परिदृश्यों में लगातार बेहतर था। जब शोधकर्ताओं ने औसत भविष्यवाणी में मामूली पूर्वाग्रह (bias) को ध्यान में रखने के लिए एक मानक सुधार लागू किया, तब भी नया मॉडल पारंपरिक मॉडल से बेहतर रहा, जिसने पुनर्निर्मित द्रव्यमान की चौड़ाई को त्रुटि के प्रकार के आधार पर 11% और 36% के बीच कम कर दिया। यह सुधार महत्वपूर्ण है क्योंकि नए भौतिकी की खोज की संवेदनशीलता सीधे इस बात पर निर्भर करती है कि सिग्नल कितनी स्पष्टता से उभरता है। एक विधि जो त्रुटिपूर्ण डिटेक्टरों के बावजूद एक स्वच्छ सिग्नल प्रदान कर सकती है, वह भविष्य के प्रयोगों के लिए एक शक्तिशाली उपकरण है। शोधकर्ता कहते हैं कि हालांकि उनका कार्य सिम्युलेटेड डेटा पर किया गया था, यह दृष्टिकोण उच्च-ऊर्जा भौतिकी की जटिल, अव्यवस्थित वास्तविकता को संभालने के लिए एक व्यवहार्य मार्ग का सुझाव देता है, जो संभावित रूप से वैज्ञानिकों को उन नए कणों को खोजने की अनुमति दे सकता है जो पहले डिटेक्टर की खामियों के धुंधलेपन में छिपे हुए थे।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →