← नवीनतम पेपर
🤖 machine learning

Information Geometry of Message Passing

यह शोध पत्र नेचुरल-ग्रेडिएंट मैसेज पासिंग (NGMP) को प्रस्तुत करता है, जो फोर्नी-शैली के फैक्टर ग्राफ्स पर एक वेरिएशनल इन्फरेंस फ्रेमवर्क है जो पड़ोसी विश्वासों के तहत फैक्टर्स का औसत निकालने के बजाय सटीक विश्वासों को एज-विशिष्ट एक्सपोनेंशियल फैमिलीज़ में स्थानीय रूप से प्रोजेक्ट करके अनिश्चितता अंशांकन (अनसर्टेन्टी कैलिब्रेशन) में सुधार करता है।

मूल लेखक: Mykola Lukashchuk, Kyrylo Yemets, Alex Ledbetter, żsmail Şenöz

प्रकाशित 2026-08-18
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Mykola Lukashchuk, Kyrylo Yemets, Alex Ledbetter, żsmail Şenöz

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

आधुनिक विज्ञान और इंजीनियरिंग की दुनिया में, कंप्यूटरों से लगातार बिखरी हुई और अधूरी जानकारी से अर्थ निकालने के लिए कहा जाता है। चाहे मौसम का पूर्वानुमान लगाना हो, बीमारी का निदान करना हो, या किसी रोबोट को निर्देशित करना हो, लक्ष्य अनिश्चितता के बीच तर्क करना होता है। इसे करने के लिए, शोधकर्ता 'बेयसियन इन्फरेंस' (Bayesian inference) नामक एक ढांचे का उपयोग करते हैं, जो ज्ञान को विश्वासों के एक समूह के रूप में मानता है जो नए साक्ष्य आने पर अपडेट होते रहते हैं। कल्पना कीजिए कि आप किसी छिपी हुई वस्तु के स्थान का अनुमान लगाने की कोशिश कर रहे हैं; आप एक सामान्य विचार से शुरू करते हैं, और फिर हर बार नया सुराग मिलने पर उस विचार को समायोजित करते हैं। चुनौती तब उत्पन्न होती है जब सुराग जटिल होते हैं और छिपी हुई वस्तु के कई चलते-फिरते हिस्से होते हैं। इन स्थितियों में, सटीक उत्तर की गणना करने के लिए आवश्यक गणित इतना भारी हो जाता है कि सबसे तेज़ सुपरकंप्यूटर भी इसे उचित समय में हल नहीं कर पाते। इसलिए वैज्ञानिकों ने शॉर्टकट विकसित किए हैं, जिन्हें 'अनुमानित विधियाँ' (approximate methods) कहा जाता है, जो पूर्ण सटीकता के बदले गति का सौदा करती हैं। ये शॉर्टकट समस्या को सरल बनाकर काम करते हैं, अक्सर यह मानकर कि सिस्टम के विभिन्न हिस्से स्वतंत्र हैं या सरल, अनुमानित पैटर्न का पालन करते हैं। हालाँकि, ये सरलीकरण कभी-कभी उन महत्वपूर्ण विवरणों को त्याग सकते हैं कि सिस्टम वास्तव में कितना अनिश्चित है, जिससे अत्यधिक आत्मविश्वासपूर्ण और संभावित रूप से खतरनाक भविष्यवाणियाँ हो सकती हैं।

शोधकर्ताओं की एक टीम ने इस संतुलन को संभालने का एक नया तरीका विकसित किया है, जो इन शॉर्टकट्स की गति को बनाए रखते हुए अनिश्चितता के खोए हुए विवरणों को वापस प्राप्त करने का विकल्प प्रदान करता है। उनका कार्य 'फैक्टर ग्राफ' (factor graph) नामक एक विशिष्ट प्रकार के गणितीय मानचित्र पर केंद्रित है, जो एक जटिल समस्या को छोटे, स्थानीय टुकड़ों में तोड़ देता है जिन्हें व्यक्तिगत रूप से हल किया जा सकता है। पारंपरिक रूप से, जब इन टुकड़ों को हल किया जाता है, तो उनके बीच सूचना का आदान-प्रदान या तो सटीक और जटिल सत्य (जो उपयोग करने के लिए बहुत धीमा है) होता है या एक सरलीकृत, औसत संस्करण (जो तेज़ है लेकिन अक्सर गलत है)। शोधकर्ताओं ने एक मध्य मार्ग खोजा। उन्होंने पाया कि वे सटीक, जटिल जानकारी को ले सकते हैं और उसे उस सरल आकार पर प्रोजेक्ट कर सकते हैं जिसे कंप्यूटर संभाल सकता है, लेकिन ऐसा करने के लिए कि मूल संदेश के सबसे महत्वपूर्ण हिस्से को सुरक्षित रखा जा सके। वे इस दृष्टिकोण को 'नेचुरल-ग्रेडिएंट मैसेज पासिंग' (natural-gradient message passing) कहते हैं। जटिलताओं को औसत निकालकर या उन्हें अनदेखा करके, यह विधि अनिश्चितता के उस विशिष्ट घटक को सावधानीपूर्वक निकालती है जो सरल मॉडल में फिट बैठता है, यह सुनिश्चित करते हुए कि अंतिम उत्तर इस बात के प्रति ईमानदार रहे कि वह क्या जानता है और क्या नहीं जानता।

शोधकर्ताओं ने इस नई विधि का परीक्षण कई वास्तविक दुनिया की समस्याओं पर किया जहाँ अनिश्चितता एक निरंतर साथी है। एक प्रयोग में, उन्होंने डेटा बिंदुओं की एक श्रृंखला को देखा, जो कई वर्षों में सौर कलंक (sunspot) गतिविधि को ट्रैक करने के समान है। जब डेटा में बड़े अंतराल आए, तो पुरानी विधियाँ खतरनाक रूप से आत्मविश्वासी हो गईं, और डेटा गायब होने पर भी एक सुचारू पथ का अनुमान लगाने लगीं। हालाँकि, नई विधि ने अनिश्चितता बैंड को सही ढंग से विस्तृत किया, यह स्वीकार करते हुए कि वह अंतराल में क्या हो रहा है, इसके बारे में नहीं जानती है। डेटा के बैचों में आने वाले प्रवाह वाले एक अन्य परीक्षण में, जैसे कि एक सेंसर जो वास्तविक समय में कंप्यूटर को जानकारी भेज रहा है, पुरानी विधियों ने छोटी त्रुटियों को संचित किया जिससे अंततः सिस्टम अत्यधिक आत्मविश्वासी हो गया और वास्तविक सिग्नल से भटक गया। नई विधि ने इस पतन से बचने में सफलता पाई, और सूचना को टुकड़ों में संसाधित करते हुए भी डेटा का एक स्थिर और सटीक दृश्य बनाए रखा। ये परिणाम दिखाते हैं कि यह विधि विशेष रूप से उन गैर-मानक, जटिल संबंधों के मामले में मूल्यवान है जहाँ सामान्य शॉर्टकट पूर्ण चित्र को पकड़ने में विफल रहते हैं।

इस खोज का मूल आधार यह है कि शोधकर्ता मॉडल के विभिन्न हिस्सों के बीच भेजे जाने वाले "संदेशों" को कैसे संभालते हैं। पुराने दृष्टिकोण में, जब एक जटिल डेटा का हिस्सा सिस्टम के सरल हिस्से को भेजा जाता था, तो सिस्टम अक्सर गणित को काम करने योग्य बनाने के लिए विवरणों को औसत निकाल देता था, जो प्रभावी रूप से तस्वीर को धुंधला कर देता था। नया तरीका इसे बदलकर, प्राप्तकर्ता छोर पर अनिश्चितता के विशिष्ट आकार को देखता है। यह जटिल संदेश को लेता है और सरल आकार के भीतर सबसे अच्छा फिट पाता है, उन हिस्सों को रखता है जो मायने रखते हैं और केवल उन्हें ही त्यागता है जिन्हें दर्शाया नहीं जा सकता। यह अनुमान लगाने या औसत निकालने का मामला नहीं है; यह एक सटीक गणितीय समायोजन है जो सुनिश्चित करता है कि सरलीकृत मॉडल यह आवश्यक जानकारी बनाए रखे कि सिस्टम वास्तव में कितना अनिश्चित है। शोधकर्ताओं ने पाया कि जब डेटा स्पष्ट होता है और अनिश्चितता कम होती है, तो नई विधि पुराने तरीकों की तरह ही अच्छा प्रदर्शन करती है। लेकिन जब डेटा शोर भरा, अधूरा, या ऐसे प्रवाह में आता है जहाँ त्रुटियां बढ़ सकती हैं, तो नई विधि चमकती है, जो दुनिया की वास्तविक स्थिति का कहीं अधिक विश्वसनीय अनुमान प्रदान करती है।

यह कार्य यह दावा नहीं करता कि यह आर्टिफिशियल इंटेलिजेंस या सांख्यिकी की हर समस्या को हल कर देगा, न ही यह सुझाव देता है कि सभी जटिल प्रणालियों के लिए अब पूर्ण उत्तर संभव हैं। इसके बजाय, यह एक विशिष्ट और सामान्य वर्ग की समस्याओं के लिए एक व्यावहारिक सुधार प्रदान करता जहाँ अनिश्चितता बनी रहती है और प्रबंधित करना कठिन होता है। शोधकर्ताओं ने प्रदर्शित किया कि मॉडल के एक भाग से दूसरे भाग में सूचना को प्रोजेक्ट करने के तरीके को बदलकर, वे सिस्टम को झूठा आत्मविश्वासी होने से रोक सकते हैं। यह मौसम के पूर्वानुमान, वित्तीय बाजारों की निगरानी, या स्वायत्त वाहनों को निर्देशित करने जैसे अनुप्रयोगों के लिए एक महत्वपूर्ण प्रगति है, जहाँ यह जानना कि आपके अपने ज्ञान की सीमाएँ क्या हैं, भविष्यवाणी करने जितना ही महत्वपूर्ण है। यह विधि गणनात्मक रूप से कुशल है, जिसका अर्थ है कि इसे चलाने के लिए बहुत अधिक अतिरिक्त समय या शक्ति की आवश्यकता नहीं होती है, जिससे यह वास्तविक दुनिया के सिस्टम के लिए एक व्यवहार्य विकल्प बन जाता है जिन्हें तेज़ और अपनी अनिश्चितताओं के प्रति ईमानदार दोनों होने की आवश्यकता है। सटीक गणनाओं और व्यावहारिक अनुमानों के बीच के अंतर को पाटकर, यह नया दृष्टिकोण मशीनों के लिए अनिश्चित दुनिया में तर्क करने का एक स्पष्ट और अधिक विश्वसनीय तरीका प्रदान करता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →