← नवीनतम पेपर
⚛️ phenomenology

Lorentz-Equivariance without Limitations

यह शोध पत्र लोरेन्त्ज़ लोकल कैनोनिकलाइजेशन (LLoCa) प्रस्तुत करता है, जो एक ऐसी विधि है जो न्यूनतम ओवरहेड के साथ किसी भी न्यूरल नेटवर्क के लिए सटीक लोरेन्त्ज़-इक्विवेरिएंस (Lorentz-equivariance) सुनिश्चित करती है, जो एम्प्लीट्यूड रिग्रेशन, इवेंट जनरेशन और जेट टैगिंग में अत्याधुनिक प्रदर्शन प्रदर्शित करते हुए सिमेट्री ब्रेकिंग के महत्व को रेखांकित करता है।

मूल लेखक: Luigi Favaro, Gerrit Gerhartz, Fred A. Hamprecht, Peter Lippmann, Sebastian Pitz, Tilman Plehn, Huilin Qu, Jonas Spinner

प्रकाशित 2026-09-23
📖 8 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Luigi Favaro, Gerrit Gerhartz, Fred A. Hamprecht, Peter Lippmann, Sebastian Pitz, Tilman Plehn, Huilin Qu, Jonas Spinner

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। ✨ नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

कण भौतिकी (particle physics) की उच्च-ऊर्जा दुनिया में, वैज्ञानिक प्रारंभिक ब्रह्मांड की स्थितियों को फिर से बनाने के लिए प्रोटॉन को लगभग प्रकाश की गति से आपस में टकराते हैं। इसके परिणामस्वरूप निकलने वाला मलबा नए कणों का एक अराजक छिड़काव होता है, जिसे विशाल डिटेक्टरों द्वारा अंतरिक्ष और समय में बिंदुओं के एक बादल के रूप में रिकॉर्ड किया जाता है। इस अराजकता को समझने के लिए, शोधकर्ता विशेष सापेक्षता (special relativity) के नियमों पर भरोसा करते हैं, जो यह कहते हैं कि भौतिकी के मौलिक नियम इस बात से नहीं बदलते कि कोई प्रेक्षक कैसे चल रहा है या वह कहाँ स्थित है। यह सिद्धांत, जिसे लोरेन्त्ज़ इनवेरियंस (Lorentz invariance) कहा जाता है, का अर्थ है कि एक कण का व्यवहार वैसा ही दिखता है चाहे उसे एक स्थिर प्रयोगशाला से देखा जाए या उच्च गति से गुजरते हुए एक अंतरिक्ष यान से। हालाँकि, जब वैज्ञानिक इन कण टकरावों का विश्लेषण करने के लिए कृत्रिम बुद्धिमत्ता (AI) का उपयोग करते हैं, तो उन्हें एक कठिन समस्या का सामना करना पड़ता है: मानक कंप्यूटर प्रोग्राम स्वाभाविक रूप से गति के इन नियमों को नहीं समझते हैं। वे डेटा को एक स्थिर चित्र की तरह मानते हैं, जिससे वे उन गहरे ज्यामितीय संबंधों को छोड़ देते हैं जो कणों की परस्पर क्रिया को नियंत्रित करते हैं। यह सीमा शोधकर्ताओं को या तो बहुत विशिष्ट, कठोर कंप्यूटर मॉडल बनाने के लिए मजबूर करती है जिन्हें अनुकूलित करना कठिन है, या फिर एक मानक मॉडल को परीक्षण और त्रुटि (trial and error) के माध्यम से नियमों का अनुमान लगाने के लिए भारी मात्रा में कंप्यूटिंग शक्ति का उपयोग करने के लिए मजबूर करती है।

भौतिकविदों और कंप्यूटर वैज्ञानिकों की एक टीम ने एक नई विधि विकसित की है जिसे लोरेन्त्ज़ लोकल कैनोनिकलाइजेशन (Lorentz Local Canonicalization), या LLoCa कहा जाता है, जो इस समस्या को हल करती है क्योंकि यह किसी भी न्यूरल नेटवर्क को बिना धीमा किए इसमें सापेक्षता की अंतर्निहित समझ प्रदान करती है। नेटवर्क को शून्य से गति के नियमों को सीखने के लिए मजबूर करने के बजाय, यह विधि नेटवर्क को प्रत्येक कण जिसे वह देखता है, उसके लिए एक व्यक्तिगत, गतिशील संदर्भ ढांचा (reference frame) बनाने की शिक्षा देती है। कल्पना कीजिए कि एक कण एक यात्री है जो अपना स्वयं का मानचित्र लेकर चलता है; नेटवर्क प्रत्येक कण के लिए इस मानचित्र की भविष्यवाणी करता है, जिससे कंप्यूटर को सभी जटिल, गतिशील डेटा को एक सरल, स्थानीय भाषा में अनुवाद करने की अनुमति मिलती है जहाँ भौतिकी के नियम पढ़ना आसान होता है। एक बार जब डेटा को इन स्थानीय ढांचों में अनुवादित कर दिया जाता है, तो नेटवर्क इसे किसी भी मानक, लचीले आर्किटेक्चर का उपयोग करके संसाधित कर सकता है। गणना पूरी होने के बाद, नेटवर्क परिणामों को डिटेक्टर के वैश्विक दृश्य (global view) में वापस अनुवादित कर देता है। यह दृष्टिकोण सुनिश्चित करता है कि कंप्यूटर ब्रह्मांड की मौलिक समरूपताओं (symmetries) का सम्मान करे और साथ ही तेज़ और विभिन्न प्रकार की भौतिक समस्याओं के लिए अनुकूल भी बना रहे।

शोधकर्ताओं ने इस नए ढांचे का परीक्षण तीन विशिष्ट चुनौतियों पर किया जो आधुनिक कण भौतिकी के केंद्र में हैं: कणों की परस्पर क्रिया की शक्ति का अनुमान लगाना, कण टकराव के यथार्थवादी सिमुलेशन उत्पन्न करना, और मलबे के भीतर छिपे विशिष्ट प्रकार के कणों की पहचान करना। पहले परीक्षण में, उन्होंने नेटवर्क से एक Z बोसोन और चार तक ग्लूऑन्स (gluons) के शामिल एक विशिष्ट प्रकीर्णन घटना (scattering event) की संभावना की भविष्यवाणी करने को कहा। उन्होंने पाया कि मानक गैर-सापेक्षतावादी मॉडलों की तुलना में, इस स्थानीय संदर्भ ढांचे प्रणाली को मानक न्यूरल नेटवर्क में जोड़ने से भविष्यवाणियां काफी अधिक सटीक हो गईं, और वे बहुत अधिक जटिल, विशिष्ट मॉडलों के प्रदर्शन से मेल खाती थीं। महत्वपूर्ण रूप से, इस नए तरीके ने इस कार्य के लिए डिज़ाइन किए गए पिछले अत्याधुनिक (state-of-the-art) मॉडलों की तुलना में बहुत कम कंप्यूटिंग प्रयास के साथ यह उच्च सटीकता प्राप्त की, जो चार गुना तेज़ थे।

दूसरे अनुप्रयोग में, टीम ने इस विधि का उपयोग शून्य से नए कण टकराव की घटनाओं को उत्पन्न करने के लिए किया। यह सिमुलेशन करने के लिए एक अत्यंत महत्वपूर्ण कार्य है कि डिटेक्टरों को क्या देखना चाहिए, लेकिन यह उल्लेखनीय रूप से कठिन है क्योंकि कंप्यूटर को संभावनाओं के एक जटिल, बहु-आयामी परिदृश्य को सीखना होता है। शोधकर्ताओं ने पाया कि इस विशिष्ट कार्य के लिए, नेटवर्क को सभी दिशाओं में पूरी तरह से सममित (symmetric) होने की आवश्यकता नहीं थी। इसके बजाय, इसने तब बेहतर प्रदर्शन किया जब इसे डिटेक्टर की विशिष्ट ज्यामिति के अनुरूप कुछ सख्त समरूपता नियमों को तोड़ने की अनुमति दी गई, क्योंकि डिटेक्टर में बीम लाइन के साथ एक पसंदीदा दिशा होती है। नेटवर्क को केवल उन समरूपताओं का सम्मान करने देने से जो वास्तव में डिटेक्टर डेटा में मौजूद हैं, उन्होंने सर्वोत्तम संभव परिणाम प्राप्त किए। यह खोज इस विचार को चुनौती देती है कि एक कंप्यूटर मॉडल को प्रभावी होने के लिए हमेशा पूरी तरह से सममित होना चाहिए; कभी-कभी, यह जानना कि समरूपता कहाँ टूटती है, उतना ही महत्वपूर्ण होता है।

अंतिम और सबसे व्यापक परीक्षण में 'जेट टैगिंग' (jet tagging) शामिल था, जो एक ऐसी प्रक्रिया है जहाँ कंप्यूटरों को भारी टॉप क्वार्क (top quarks) के कारण होने वाले कणों के जेट और साधारण बैकग्राउंड शोर के बीच अंतर करना होता है। यह नई भौतिकी खोजने के लिए एक महत्वपूर्ण कौशल है, क्योंकि टॉप क्वार्क अक्सर दुर्लभ, दिलचस्प घटनाओं में उत्पन्न होते हैं। टीम ने अपने तरीके को कई स्थापित, उच्च-प्रदर्शन वाले नेटवर्क आर्किटेक्चर पर लागू किया, जिससे उन्हें सापेक्षतावादी (relativistic) बनाया गया। उन्होंने इन मॉडलों को प्रशिक्षित करने के लिए 135 मिलियन सिम्युलेटेड घटनाओं वाला एक विशाल नया डेटासेट बनाया, जो इस विशिष्ट कार्य के लिए उपयोग किए गए किसी भी पिछले डेटासेट से बहुत बड़ा है। इस बड़े पैमाने पर, अपग्रेड किए गए नेटवर्क अपने गैर-सापेक्षतावादी समकक्षों से बेहतर प्रदर्शन करते हैं और सबसे उन्नत विशिष्ट मॉडलों के प्रदर्शन से मेल खाते हैं। परिणामों ने दिखाया कि जबकि यह नया तरीका छोटे डेटासेट पर अच्छा काम करता है, इसकी वास्तविक शक्ति तब प्रकट होती है जब डेटा की मात्रा बड़ी होती है, जिससे नेटवर्क अधिक कुशलता से सीखने के लिए भौतिकी के नियमों का लाभ उठा पाता है।

अध्ययन से एक प्रमुख अंतर्दृष्टि डेटा की समरूपता को नेटवर्क कैसे संभालता है, इससे संबंधित है। शोधकर्ताओं ने पाया कि कुछ कार्यों के लिए, जैसे कि घटनाएं उत्पन्न करना, यह पर्याप्त है कि नेटवर्क केवल डिटेक्टर की अवशिष्ट समरूपता (residual symmetry) का सम्मान करे। हालाँकि, जेट्स में कणों की पहचान करने के लिए, सबसे अच्छा प्रदर्शन एक हाइब्रिड दृष्टिकोण से आया। नेटवर्क को अपने आंतरिक गणनाओं में पूर्ण सापेक्षतावादी समरूपता का उपयोग करने की अनुमति दी गई, लेकिन इसे कण बीम की दिशा जैसे विशिष्ट संदर्भ बिंदु भी दिए गए। इसने नेटवर्क को यह तय करने की अनुमति दी कि उसे कब पूर्ण समरूपता का उपयोग करना है और कब विशिष्ट डिटेक्टर ज्यामिति पर भरोसा करना है। यह लचीलापन सबसे प्रभावी रणनीति साबित हुआ, जिससे मॉडल को उन कठोर नियमों से बंधे बिना उच्चतम सटीकता प्राप्त करने में मदद मिली जो हर डेटा के हिस्से पर लागू नहीं होते हैं।

अध्ययन ने यह भी प्रदर्शित किया कि यह नया ढांचा केवल एक प्रकार के न्यूरल नेटवर्क तक सीमित नहीं है। शोधकर्ताओं ने सफलतापूर्वक ग्राफ नेटवर्क (जो कणों को जुड़े हुए नोड्स के रूप में मानते हैं) और ट्रांसफॉर्मर (जो अक्सर भाषा प्रसंस्करण में उपयोग किए जाने वाले शक्तिशाली मॉडल हैं) दोनों पर इसे लागू किया। हर मामले में, यह विधि एक सार्वभौमिक अपग्रेड के रूप में कार्य करती है, जो मौजूदा नेटवर्क को लेकर उसे सापेक्षतावादी बनाती है और इसमें समायोज्य मापदंडों (parameters) की संख्या में बहुत मामूली वृद्धि होती है। इस अपग्रेड की कम्प्यूटेशनल लागत न्यूनतम थी, जिससे कुल मापदंडों में केवल लगभग एक प्रतिशत की वृद्धि हुई और इसके लिए नगण्य अतिरिक्त समय लगा। यह सुझाव देता है कि इस पद्धति को पूरे सॉफ़्टवेयर सिस्टम को फिर से लिखे बिना मौजूदा उपकरणों को बेहतर बनाने के लिए व्यापक भौतिकी समुदाय द्वारा आसानी से अपनाया जा सकता है।

मौलिक समरूपताओं को न्यूनतम ओवरहेड के साथ मशीन लर्निंग मॉडल में शामिल करने का एक तरीका प्रदान करके, यह कार्य कण भौतिकी में प्रगति के एक बड़े अवरोध को हटा देता है। यह शोधकर्ताओं को आज उपलब्ध सबसे शक्तिशाली और लचीले न्यूरल नेटवर्क आर्किटेक्चर का उपयोग करने की अनुमति देता है जबकि यह सुनिश्चित करता है कि वे प्रकृति के नियमों का सम्मान करें। बेहतर सिमुलेशन उत्पन्न करने, परस्पर क्रिया की शक्ति की अधिक सटीक भविष्यवाणी करने और दुर्लभ कणों को उच्च विश्वास के साथ पहचानने की क्षमता भविष्य के कण टकरावों से अपेक्षित डेटा के विश्लेषण के लिए नए द्वार खोलती है। शोधकर्ताओं ने अपना कोड और डेटासेट सार्वजनिक रूप से उपलब्ध करा दिया है, जिससे अन्य लोगों को इन उपकरणों का परीक्षण करने और उन्हें परिष्कृत करने के लिए आमंत्रित किया गया है, जिससे यह सुनिश्चित हो सके कि कण भौतिकी में अगली पीढ़ी की खोजें डेटा और गहरी भौतिक समझ दोनों की नींव पर बनी हों।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →