DeepCNet: A multimodal deep learning model for predicting cell type-specific gene expression and promoter-enhancer interactions from single-cell multiome data
DeepCNet एक नवीन मल्टीमॉडल डीप लर्निंग फ्रेमवर्क है जो सिंगल-सेल मल्टीओम डेटा का लाभ उठाकर कोशिका प्रकार-विशिष्ट जीन अभिव्यक्ति की सटीक भविष्यवाणी करता है और नियामक प्रमोटर-एन्हांसर इंटरैक्शन का अनुमान लगाता है, जिससे ट्रांसक्रिप्शन फैक्टर जीन रेगुलेटरी नेटवर्क का निर्माण और अल्जाइमर जैसी बीमारियों में स्थिति-विशिष्ट नियामक परिवर्तनों की पहचान संभव हो पाती है।
मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। यह एक ऐसे प्रीप्रिंट की AI से तैयार की गई व्याख्या है जिसकी अभी सहकर्मी समीक्षा नहीं हुई है। यह चिकित्सकीय सलाह नहीं है। इस सामग्री के आधार पर स्वास्थ्य संबंधी फैसले न लें। पूरा डिस्क्लेमर पढ़ें
मानव शरीर की प्रत्येक कोशिका के भीतर, निर्देशों का एक विशाल पुस्तकालय प्रतीक्षा कर रहा है। यह पुस्तकालय डीएनए (DNA) में लिखा गया है, जो एक लंबा रासायनिक कोड है जो यह निर्धारित करता है कि एक कोशिका कैसे व्यवहार करती है, वह कैसी दिखती है, और वह क्या कार्य करती है। हालाँकि, कोड अपने आप में कहानी का केवल एक हिस्सा है। यह समझने के लिए कि एक कोशिका कैसे कार्य करती है, वैज्ञानिकों को यह भी समझना चाहिए कि कोशिका यह कैसे तय करती है कि कोड के किन हिस्सों को पढ़ना है और किन्हें अनदेखा करना है। यह निर्णय लेने की प्रक्रिया प्रमोटरों (promoters) और एन्हांसरों (enhancers) नामक सूक्ष्म स्विचों पर निर्भर करती है। प्रमोटर एक जीन के ठीक बगल में स्थित होते हैं, जो एक मुख्य द्वार की तरह कार्य करते हैं, जबकि एन्हांसर रिमोट कंट्रोल की तरह होते हैं जो दूर स्थित हो सकते हैं, कभी-कभी डीएनए कोड के हजारों अक्षरों दूर। जब किसी कोशिका को एक विशिष्ट जीन को सक्रिय करने की आवश्यकता होती है, तो इन दोनों भागों को भौतिक रूप से एक साथ आना पड़ता है, जिससे जीन को चालू करने के लिए डीएनए स्ट्रैंड में एक लूप बनता है। हर अलग प्रकार की कोशिका में यह पता लगाना कि कौन सा रिमोट कंट्रोल किस मुख्य द्वार से जुड़ता है, आधुनिक जीव विज्ञान की सबसे कठिन पहेलियों में से एक है।
लंबे समय तक, वैज्ञानिक इन कनेक्शनों का अध्ययन लाखों कोशिकाओं के मिश्रण को एक साथ देखकर कर सकते थे, जैसे कि एक भीड़ भरे स्टेडियम की आवाज़ों को सुनकर किसी बातचीत को समझने की कोशिश करना। इस दृष्टिकोण ने व्यक्तिगत कोशिका प्रकारों की अनूठी आवाज़ों को धुंधला कर दिया। हालिया तकनीक ने शोधकर्ताओं को एकल कोशिकाओं में डीएनए और जीनों की गतिविधि को देखने की अनुमति देकर इसे बदल दिया है, जिससे प्रतिरक्षा कोशिकाओं (immune cells), मस्तिष्क की कोशिकाओं और अन्य के विशिष्ट नियामक कार्यक्रमों का पता चला है। फिर भी, इस उच्च-रिज़ॉल्यूशन दृश्य के साथ भी, यह अनुमान लगाना कि ये दूरस्थ स्विच अपने लक्षित जीनों से कैसे जुड़ते हैं, एक बड़ी चुनौती बनी हुई है। मौजूदा कंप्यूटर मॉडल अक्सर इन अंतःक्रियाओं की जटिलता के साथ तालमेल बिठाने में संघर्ष करते हैं, विशेष रूप से जब अल्जाइमर जैसी बीमारियों में इन कनेक्शनों के बदलने को समझने की कोशिश की जाती है।
फ्लोरिडा विश्वविद्यालय के शोधकर्ताओं ने इस समस्या को हल करने के लिए 'डीपसीएनटी' (DeepCNet) नामक एक नया कंप्यूटर प्रोग्राम विकसित किया है। यह उपकरण कच्चे डीएनए अनुक्रम और कोशिकाओं के जटिल व्यवहार के बीच एक सेतु के रूप में कार्य करने के लिए डिज़ाइन किया गया है। केवल अनुमान लगाने के बजाय, DeepCNet वास्तविक डेटा से सीखता है कि एक विशिष्ट प्रकार की कोशिका में एक जीन कैसे व्यवहार करेगा। यह दो मुख्य चीजों को देखकर ऐसा करता है: डीएनए अक्षरों का अनुक्रम और डीएनए की भौतिक सुलभता (accessibility), जो कंप्यूटर को बताता है कि कोड के कौन से हिस्से खुले और पढ़े जाने के लिए तैयार हैं। इन दो सूचना स्रोतों को जोड़कर, प्रोग्राम यह निष्कर्ष निकाल सकता है कि कौन से एन्हांसर संभवतः किन जीनों से बात कर रहे हैं।
शोधकर्ताओं ने मानव रक्त और मस्तिष्क के ऊतकों के डेटा पर DeepCNet का परीक्षण किया। उन्होंने कंप्यूटर से पूछा कि रक्त में प्रतिरक्षा कोशिकाओं या मस्तिष्क में न्यूरॉन्स जैसे विभिन्न कोशिका प्रकारों में कुछ जीन कितने सक्रिय होंगे। जब उन्होंने DeepCNet के अनुमानों की तुलना कोशिकाओं से लिए गए वास्तविक मापों से की, तो नए प्रोग्राम ने अन्य सभी मौजूदा तरीकों की तुलना में बेहतर प्रदर्शन किया। यह जीन गतिविधि की शक्ति का अनुमान लगाने में अधिक सटीक था और महत्वपूर्ण रूप से, यह दूरस्थ एन्हांसरों और उनके द्वारा नियंत्रित जीनों के बीच सही कनेक्शन की पहचान करने में बेहतर था। इसकी विश्वसनीयता सिद्ध करने के लिए, टीम ने स्वतंत्र प्रयोगात्मक डेटा के विरुद्ध DeepCNet के अनुमानों की जांच की, जिसमें डीएनए लूप के भौतिक मानचित्र और उन प्रयोगों के परिणाम शामिल थे जहाँ विशिष्ट डीएनए स्विचों को बंद कर दिया गया था। हर मामले में, DeepCNet के अनुमानित कनेक्शन अन्य मॉडलों की तुलना में वास्तविक दुनिया के साक्ष्यों से अधिक निकटता से मेल खाते थे।
केवल जीन गतिविधि की भविष्यवाणी करने के अलावा, DeepCNet वैज्ञानिकों को उन नियामक नेटवर्कों को मैप करने की अनुमति देता है जो कोशिका व्यवहार को नियंत्रित करते हैं। शोधकर्ताओं ने इस उपकरण का उपयोग यह समझने के लिए किया कि ट्रांसक्रिप्शन फैक्टर्स (transcription factors)—जो जीनों के मास्टर स्विच के रूप में कार्य करते हैं—अपने लक्ष्यों को कैसे नियंत्रित करते हैं। प्रोग्राम ने ज्ञात नियामकों की पहचान की और यह भी दिखाया कि वे विशिष्ट कोशिका प्रकारों में एक साथ कैसे कार्य करते हैं। उदाहरण के लिए, इसने उजागर किया कि कैसे कुछ प्रोटीन प्रतिरक्षा प्रतिक्रिया को प्रबंधित करने के लिए समन्वय करते हैं, जो उन साझा नियमों को भी दर्शाता है जो कई कोशिकाओं पर लागू होते हैं और उन अद्वितीय नियमों को भी जो विशिष्ट कोशिका प्रकारों को परिभाषित करते हैं।
DeepCNet की शक्ति बीमारी को समझने तक विस्तृत है। शोधकर्ताओं ने यह देखने के लिए कि मस्तिष्क में नियामक कनेक्शन कैसे बदलते हैं, एक अल्जाइमर रोग वाले रोगी और एक स्वस्थ नियंत्रण व्यक्ति के डेटा पर इस टूल को लागू किया। दोनों की तुलना करके, प्रोग्राम ने उन विशिष्ट उदाहरणों की पहचान की जहाँ एक जीन और उसके स्विच के बीच का संबंध रोग की स्थिति में बदल गया था। अल्जाइमर के रोगी की मस्तिष्क कोशिकाओं में, प्रोग्राम ने पाया कि 'AIF1' नामक जीन और उसके नियामक स्विच के बीच का संबंध मजबूत हुआ था, जो इस बीमारी में सूजन (inflammation) के बारे में ज्ञात तथ्यों के अनुरूप है। इसने 'SLC20A2' नामक दूसरे जीन के लिए एक कमजोर संबंध को भी पहचाना। ये निष्कर्ष बताते हैं कि बीमारी केवल जीन के चालू या बंद होने के बारे में नहीं है, बल्कि यह जीनोम की भौतिक वायरिंग के पुनर्गठन (rewiring) के बारे में है।
शोधकर्ता इस बात पर जोर देते हैं कि हालांकि DeepCNet इन परिवर्तनों के लिए मजबूत कम्प्यूटेशनल साक्ष्य प्रदान करता है, लेकिन एक विशिष्ट रोगी और एक स्वस्थ व्यक्ति के बीच इस विशेष तुलना से प्राप्त निष्कर्षों को अंतिम निदान के बजाय आगे के अध्ययन के लिए उम्मीदवार के रूप में देखा जाना चाहिए। यह उपकरण यह बताने के लिए डिज़ाइन किया गया है कि वैज्ञानिकों को आगे कहाँ देखना चाहिए। जीनोम कैसे व्यवस्थित है और बीमारी में यह कैसे बदलता है, इसका स्पष्ट चित्र प्रदान करके, DeepCNet मानव स्वास्थ्य और बीमारी को संचालित करने वाले छिपे हुए तंत्रों को खोजने का एक नया तरीका प्रदान करता है, जो एक जटिल जैविक पहेली को एक ऐसे मानचित्र में बदल देता है जिसका शोधकर्ता वास्तव में अनुसरण कर सकते हैं।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।