← नवीनतम पेपर
📊 statistics

Detecting Jumps on a Tree: a Hierarchical Normalized Stable Process Model for Evolution of Discrete Distributions

यह शोध पत्र एक पदानुक्रमित सामान्यीकृत स्टेबल प्रक्रिया (hierarchical normalized stable process) और एक पॉइसन प्रक्रिया (Poisson process) पर आधारित एक नॉनपैरामीट्रिक बेयसियन मॉडल प्रस्तावित करता है ताकि उप-जनसंख्याओं में साझा सांख्यिकीय जानकारी का लाभ उठाकर और पोस्टीरियर इन्फरेंस के लिए एक कुशल पार्टिकल एमसीएमसी (particle MCMC) एल्गोरिदम का उपयोग करके, ट्री-स्ट्रक्चर्ड आबादी, जैसे कि फाइलोगैनेटिक ट्री (phylogenetic trees), पर वितरण जंप (distributional jumps) का पता लगाया जा सके।

मूल लेखक: Hanxi Sun, Heejung Shim, Vinayak Rao

प्रकाशित 2026-09-09
📖 6 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Hanxi Sun, Heejung Shim, Vinayak Rao

मूल पेपर CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। नीचे दिए गए पेपर की यह व्याख्या AI से तैयार की गई है। इसे लेखकों ने न तो लिखा है, न इसका समर्थन किया है। तकनीकी सटीकता के लिए मूल पेपर देखें। पूरा डिस्क्लेमर पढ़ें

पृथ्वी पर जीवन हर प्रजाति के डीएनए में लिखी एक विशाल, शाखाओं वाली कहानी है। वैज्ञानिकों ने लंबे समय से इन पारिवारिक पेड़ों का उपयोग किया है, जिन्हें फाइलोजेनेटिक ट्री (phylogenetic trees) कहा जाता है, ताकि यह पता लगाया जा सके कि विभिन्न जीव समूहों के बीच कैसे संबंध हैं और समय के साथ वे कैसे बदले हैं। एक ऐसे पेड़ की कल्पना करें जहाँ तना सबसे पुराने सामान्य पूर्वज का प्रतिनिधित्व करता है और सबसे ऊपर की टहनियाँ आज जीवित प्रजातियों का प्रतिनिधित्व करती हैं। दशकों से, शोधकर्ताओं ने यह समझने की कोशिश की है कि जैसे-जैसे आप तने से टहनियों की ओर बढ़ते हैं, विशिष्ट लक्षण—जैसे कि किसी वायरस की प्रतिरक्षा प्रणाली से बचने की क्षमता या किसी भाषा का पारिवारिक जीवन का वर्णन करने का तरीका—कैसे विकसित होते हैं। पारंपरिक दृष्टिकोण अक्सर यह मानता था कि ये परिवर्तन धीरे-धीरे और निरंतर होते हैं, जैसे कि एक मंद बहाव। हालाँकि, विकास (evolution) अचानक होने वाले तीव्र बदलावों से भी चिह्नित हो सकता है जहाँ किसी जनसंख्या की विशेषताओं में अचानक परिवर्तन आता है। इन अचानक बदलावों का पता लगाना कठिन है क्योंकि डेटा अक्सर अव्यवस्थित होता है, जिसमें कई प्रजातियों के पास बहुत कम दर्ज उदाहरण होते हैं, जिससे यह बताना मुश्किल हो जाता है कि क्या कोई परिवर्तन वास्तविक है या केवल नमूनाकरण (sampling) का एक संयोग।

पर्ड्यू यूनिवर्सिटी और मेलबर्न यूनिवर्सिटी के सांख्यिकीविदों की एक टीम ने इन विकासवादी पेड़ों पर इन अचानक बदलावों को पहचानने का एक नया तरीका विकसित किया है। उनका कार्य एक ऐसी पद्धति पर केंद्रित है जो लक्षणों के विकास को एक एकल सुचारू रेखा के रूप में नहीं, बल्कि संभावित छलांगों (jumps) की एक श्रृंखला के रूप में देखती है। उन्होंने एक परिष्कृत कंप्यूटर मॉडल बनाया जो पूरे पेड़ को एक साथ देखता है, जिससे यह संबंधित समूहों से शक्ति उधार लेकर परिवर्तनों के बारे में बेहतर अनुमान लगा सकता है। यह मानते हुए कि प्रत्येक शाखा अलग-थलग विकसित होती है, उनका मॉडल यह समझता है कि प्रजातियों का एक समूह अपने करीबी रिश्तेदारों के समान होने की संभावना रखता है जब तक कि किसी विशिष्ट घटना ने परिवर्तन का कारण न दिया हो। इस विचार को अनिश्चितता को कुशलता से संभालने वाले एक गणितीय उपकरण के साथ जोड़कर, उन्होंने एक ऐसी प्रणाली बनाई है जो यह पहचान सकती है कि पेड़ पर ये छलांगें वास्तव में कहाँ हुईं, भले ही डेटा विरल हो या परिवर्तन बहुत सूक्ष्म हों।

शोधकर्ताओं ने अपने दृष्टिकोण का परीक्षण करने के लिए कृत्रिम और वास्तविक दुनिया के उदाहरणों दोनों का उपयोग किया कि यह कितनी अच्छी तरह काम करता है। परीक्षणों के एक सेट में, उन्होंने ज्ञात छलांगों वाले सिंथेटिक पेड़ बनाए और पाया कि उनकी विधि छोटे, क्रमिक परिवर्तनों को पकड़ने में पिछले उपकरणों की तुलना में कहीं अधिक बेहतर थी, जो अक्सर उन्हें पूरी तरह से छोड़ देते थे। जब परिवर्तन बड़े और स्पष्ट थे, तो दोनों विधियों ने अच्छा प्रदर्शन किया, लेकिन नया दृष्टिकोण तब स्पष्ट लाभ दिखाता है जब संकेत कमजोर होता है। यह अत्यंत महत्वपूर्ण है क्योंकि वास्तविक दुनिया में, विकासवादी बदलाव अक्सर छोटे और पता लगाने में कठिन होते हैं। टीम ने अपने मॉडल को एक वायरस और मानव प्रतिरक्षा प्रणाली से जुड़े वास्तविक डेटासेट पर लागू किया। उन्होंने 261 वायरसों के आनुवंशिक अनुक्रमों से बने एक पेड़ का विश्लेषण किया और देखा कि एक विशिष्ट प्रतिरक्षा मार्कर कितनी बार दिखाई देता है। उनके मॉडल ने सफलतापूर्वक एक विशिष्ट शाखा की पहचान की जहाँ इस मार्कर की आवृत्ति में महत्वपूर्ण उछाल आया, जिसने अन्य शोधकर्ताओं द्वारा की गई खोज की पुष्टि की, लेकिन इसे एक अधिक मजबूत सांख्यिकीय ढांचे के साथ किया जो पेड़ की संरचना को ध्यान में रखता है।

एक अन्य वास्तविक दुनिया के अनुप्रयोग में, टीम ने यूटो-अज़टेक (Uto-Aztecan) भाषा परिवार के सामाजिक रीति-रिवाजों की जांच की, विशेष रूप से यह कि नए विवाहित जोड़े रहने के लिए स्थान का चुनाव कैसे करते हैं। यह डेटा एक साधारण हाँ या ना के उत्तर से अधिक जटिल है, क्योंकि इसमें निवास के चार अलग-अलग वर्ग शामिल हैं। शोधकर्ताओं ने भाषा के पेड़ में दो विशिष्ट छलांगों के प्रमाण पाए। पहली छलांग ने स्वतंत्र घर स्थापित करने की ओर बदलाव को चिह्नित किया, जो संभवतः खराब मिट्टी वाले क्षेत्रों में नई कृषि भूमि खोजने की आवश्यकता को दर्शाता था। दूसरी छलांग ने पत्नी के परिवार के साथ रहने या मिश्रित व्यवस्थाओं की ओर बदलाव का संकेत दिया, जो रेगिस्तानी और मैदानी वातावरण में जाने के अनुरूप था। मॉडल ने बहुत उच्च संभावना की गणना की कि ये दो परिवर्तन वास्तविक थे और केवल यादृच्छिक शोर (random noise) नहीं थे, जिससे ठीक से पता चला कि भाषा के पेड़ की किन शाखाओं में ये नए सामाजिक पैटर्न मौजूद थे।

इस नए तरीके का मूल तत्व यह है कि यह पेड़ के विभिन्न हिस्सों के बीच संबंधों को कैसे संभालता है। अलग-अलग घटनाओं के रूप में प्रत्येक छलांग को देखने वाले पुराने मॉडलों के विपरीत, यह दृष्टिकोण परिवर्तनों को आपस में जोड़ता है। यह मान लेता है कि यदि एक शाखा पर परिवर्तन होता है, तो अगली शाखा एक डिफ़ॉल्ट स्थिति पर रीसेट होने के बजाय उस नई स्थिति से शुरू होने की संभावना रखती है। यह मॉडल को पूरे पेड़ में जानकारी साझा करने की अनुमति देता है; यदि प्रजातियों के एक समूह के पास बहुत कम डेटा है, तो मॉडल बेहतर निर्णय लेने के लिए अपने पड़ोसियों को देख सकता है। शोधकर्ताओं ने इन जटिल गणनाओं को चलाने के लिए एक तेज़ कंप्यूटर एल्गोरिदम भी विकसित किया, जिससे यह सुनिश्चित हुआ कि यह विधि बड़े डेटासेट के लिए व्यावहारिक है। पेड़ को अलग-थलग बिंदुओं के संग्रह के बजाय एक जुड़े हुए पदानुक्रम (hierarchy) के रूप में मानकर, वे उन विकासवादी कहानियों को उजागर करने में सक्षम हुए जो पहले डेटा के शोर में छिपी हुई थीं।

परिणाम बताते हैं कि यह पदानुकरणीय दृष्टिकोण लक्षणों के विकास का अध्ययन करने का एक अधिक विश्वसनीय तरीका प्रदान करता है, विशेष रूप से तब जब परिवर्तन छोटे हों या डेटा सीमित हो। टीम ने प्रदर्शित किया कि उनकी विधि उन सूक्ष्म बदलावों का पता लगाने में सक्षम थी जिन्हें अन्य उपकरण चूक गए थे, जिससे विकासवादी इतिहास की एक स्पष्ट तस्वीर मिली। जबकि वर्तमान कार्य उन लक्षणों पर केंद्रित है जो विशिष्ट श्रेणियों में आते हैं, लेखकों का कहना है कि इस ढांचे को अंततः निरंतर लक्षणों (continuous traits), जैसे शरीर का आकार या तापमान, के लिए अनुकूलित किया जा सकता है, और यह पेड़ के आकार की अनिश्चितता को भी ध्यान में रख सकता है। फिलहाल के लिए, यह विधि जीवविज्ञानियों और भाषाविदों दोनों के लिए एक शक्तिशाली उपकरण के रूप में खड़ी है, जो जीवन और संस्कृति के शाखाओं वाले पथों को देखने के लिए एक स्पष्ट लेंस प्रदान करती है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →