Integration of proteomic data from cell lines and tumors
लेखक ProtInt पेश करते हैं, जो एक डीप लर्निंग फ्रेमवर्क है जो मिसिंग वैल्यू (लापता मान) की चुनौतियों पर विजय पाकर कैंसर सेल लाइन्स और रोगी के ट्यूमर से प्राप्त प्रोटिओमिक डेटा को सफलतापूर्वक एकीकृत करता है, जिससे यह मौजूदा विधियों से बेहतर प्रदर्शन करता है और प्रीक्लिनिकल मॉडल्स को क्लिनिकल वास्तविकता के साथ बेहतर ढंग से संरेखित करने के लिए आवश्यक प्रमुख जैविक बदलावों को प्रकट करता है।
मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। यह एक ऐसे प्रीप्रिंट की AI से तैयार की गई व्याख्या है जिसकी अभी सहकर्मी समीक्षा नहीं हुई है। यह चिकित्सकीय सलाह नहीं है। इस सामग्री के आधार पर स्वास्थ्य संबंधी फैसले न लें। पूरा डिस्क्लेमर पढ़ें
कैंसर अनुसंधान काफी हद तक एक सरल, शक्तिशाली उपकरण पर निर्भर करता है: कैंसर सेल लाइन (cancer cell line)। ये प्रयोगशाला की डिश में उगाए गए कैंसर कोशिकाओं के समूह हैं, जिन्हें दशकों तक जीवित रखा जाता है और वैज्ञानिकों द्वारा यह अध्ययन करने के लिए उपयोग किया जाता है कि ट्यूमर कैसे व्यवहार करते हैं और नई दवाओं का परीक्षण करने के लिए। क्योंकि इन्हें उगाना और साझा करना आसान है, इसलिए वे प्रीक्लिनिकल अध्ययनों की रीढ़ बनते हैं। हालांकि, एक जिद्दी समस्या लंबे समय से इस क्षेत्र को परेशान कर रही है: डिश में उगाई गई इन कोशिकाओं से प्राप्त निष्कर्ष अक्सर वास्तविक रोगियों के लिए सफल उपचार में विफल हो जाते हैं। पेट्री डिश में मौजूद कोशिकाओं में मानव शरीर के जटिल वातावरण का अभाव होता है, और समय के साथ, वे आनुवंशिक और रासायनिक रूप से उन ट्यूमर से दूर जा सकती हैं जिनसे उन्हें मूल रूप से लिया गया था। इस अंतर को पाटने के लिए, शोधकर्ताओं को इन लैब-उगाई गई कोशिकाओं की आणविक संरचना की सीधे वास्तविक रोगी ट्यूमर की आणविक संरचना के साथ तुलना करने के तरीके की आवश्यकता है। जबकि वैज्ञानिक इन दोनों समूहों के आनुवंशिक निर्देशों, या आरएनए (RNA), की सफलतापूर्वक तुलना कर चुके हैं, प्रोटीनों के लिए एक समान तुलना—जो कि वास्तविक कार्यशील अणु हैं जिन्हें दवाएं आमतौर पर लक्षित करती हैं—एक पहुंच से बाहर बनी हुई थी। ऐसा मुख्य रूप से इसलिए है क्योंकि प्रोटीन डेटा विशेष रूप से अव्यवस्थित होता है, और उन्हें मापने के लिए उपयोग किए जाने वाले मशीनों की सीमाओं के कारण जानकारी के बड़े हिस्से अक्सर गायब रहते हैं।
शोधकर्ताओं की एक टीम ने इस विशिष्ट पहेली को सुलझाने के लिए 'प्रोटइंट' (ProtInt) नामक एक नई विधि विकसित की है। उन्होंने इस दृष्टिकोण को एक विशाल डेटा संग्रह पर लागू किया, जिसमें 13 अलग-अलग ऊतक प्रकारों (tissue types) में 771 विभिन्न कैंसर सेल लाइनों के प्रोटीन माप और 550 उपचार-पूर्व (treatment-naïve) रोगी ट्यूमर के डेटा को जोड़ा गया। लक्ष्य एक एकीकृत मानचित्र बनाना था जहाँ इन दो अलग-अलग समूहों को अगल-बगल देखा जा सके, न कि दो अलग द्वीपों के रूप में, बल्कि एक ही परिदृश्य के हिस्सों के रूप में। शोधकर्ताओं ने पाया कि डेटा को साफ करने या आनुवंशिक जानकारी को संरेखित करने के लिए उपयोग की जाने वाली मानक विधियाँ प्रोटीन डेटासेट में पाए जाने वाले अद्वितीय अंतराल और लुप्त मानों को संभालने में सक्षम नहीं थीं। जब उन्होंने इन पुरानी विधियों को काम करने के लिए मजबूर किया, तो सेल लाइन और ट्यूमर जिद्दी रूप से अलग ही रहे। प्रोटिंट, हालांकि, एक परिष्कृत शिक्षण प्रणाली का उपयोग करता है जो यह समझता है कि प्रोटीन को कैसे मापा जाता है और डेटा क्यों गायब होता है। यह रिक्त स्थानों को एक यथार्थवादी तरीके से भरने के साथ-साथ डेटा को इस तरह समायोजित करना सीखता है कि सेल लाइनों और ट्यूमरों की सीधे तुलना की जा सके।
परिणामों ने दिखाया कि प्रोटिंट ने दोनों डेटासेट को सफलतापूर्वक जोड़ दिया। नए, एकीकृत दृश्य में, लैब-उगाई गई कोशिकाओं और रोगी ट्यूमर के बीच का कृत्रिम अलगाव समाप्त हो गया। दो अलग-अलग समूहों के बजाय, नमूने उनके ऊतक के प्रकार के आधार पर एक साथ समूहबद्ध होने लगे, जैसे कि फेफड़े, स्तन या रक्त। यह संरेखण हर एक ऊतक प्रकार के लिए पूर्णतः सटीक नहीं था; उदाहरण के लिए, केंद्रीय तंत्रिका तंत्र और चिकनी मांसपेशियों (smooth muscle) की सेल लाइनों को अपने ट्यूमर समकक्षों के साथ तालमेल बिठाने में संघर्ष करना पड़ा, जो संभवतः इसलिए है क्योंकि ये विशिष्ट कोशिकाएं डिश में उगाने पर महत्वपूर्ण रूप से बदल जाती हैं। हालांकि, कई अन्य ऊतकों के लिए, यह विधि उल्लेखनीय रूप से अच्छी तरह से काम करती है। जब शोधकर्ताओं ने बारीकी से देखा कि इस संरेखण के दौरान क्या बदला, तो उन्हें एक स्पष्ट जैविक कहानी उभरती हुई दिखाई दी। जैसे-जैसे सेल लाइनों को वास्तविक ट्यूमर की तरह दिखने के लिए समायोजित किया गया, उनकी प्रोटीन प्रोफाइल अनुमानित तरीकों से बदलीं। उनमें प्रतिरक्षा प्रणाली, कोशिकाओं के बीच संचार, और आसपास के ऊतक संरचना के साथ अंतःक्रिया से संबंधित प्रोटीनों में वृद्धि देखी गई। साथ ही, बुनियादी कोशिकीय मशीनरी, जैसे कि आनुवंशिक निर्देशों की नकल करने और ऊर्जा उत्पन्न करने में शामिल प्रोटीनों में कमी आई। यह बदलाव इस वास्तविकता को दर्शाता है कि वास्तविक ट्यूमर एक जटिल शारीरिक वातावरण के भीतर मौजूद होते हैं, जबकि लैब कोशिकाएं अक्सर अलग-थलग होती हैं और केवल तीव्र विकास पर केंद्रित होती हैं।
अध्ययन ने यह भी परीक्षण किया कि क्या विभिन्न गणितीय रणनीतियाँ इसी तरह का परिणाम प्राप्त कर सकती हैं। शोधकर्ताओं ने अपनी विधि की तुलना अन्यों से की जो विभिन्न शिक्षण तकनीकों पर निर्भर करती हैं, जैसे कि वे जो डेटा को अपने मूल रूप में वापस लाने के लिए मजबूर करती हैं। उन्होंने पाया कि वैकल्पिक दृष्टिकोण उतने बेहतर प्रदर्शन नहीं कर सके; या तो वे डेटा को प्रभावी ढंग से मिलाने में विफल रहे या उन्होंने बहुत अधिक त्रुटि उत्पन्न की। प्रोटिंट बेहतर साबित हुआ क्योंकि इसने विशेष रूप से इस बात का हिसाब रखा कि प्रोटीन प्रयोगों में लुप्त डेटा कैसे व्यवहार करता है, और अंतराल को यादृच्छिक शोर (random noise) के बजाय एक प्रोटीन की प्रचुरता से संबंधित पैटर्न के रूप में माना। इसने लुप्त मानों को उच्च सटीकता के साथ पुनर्गठित किया, जिससे यह सुनिश्चित हुआ कि अंतिम तुलना एक पूर्ण चित्र पर आधारित है। शोधकर्ताओं ने उल्लेख किया कि हालांकि यह विधि उनके द्वारा उपयोग किए गए प्रोटीन डेटा के प्रकार के लिए अच्छी तरह से काम करती है, लेकिन यह अन्य सामान्य प्रयोगशाला तकनीकों के लिए अभी तैयार नहीं है जो प्रोटीनों को अलग तरह से लेबल करती हैं।
अंततः, यह कार्य जटिल जैविक डेटा को समझने के लिए एक नया ढांचा प्रदान करता है। सेल लाइनों और ट्यूमर के प्रोटिओम (proteomes) को सफलतापूर्वक एकीकृत करके, प्रोटिंट यह पहचानने का एक तरीका प्रदान करता है कि कौन सी प्रयोगशाला सेल लाइनें विशिष्ट रोगी कैंसर के लिए सबसे अच्छा मिलान हैं। यह वैज्ञानिकों को उनके प्रयोगों के लिए सबसे प्रासंगिक मॉडल चुनने में मदद कर सकता है, जिससे संभावित रूप से विफल नैदानिक परीक्षणों की संख्या कम हो सकती है। यह विधि दावा नहीं करती है कि उसने कैंसर उपचार की पूरी समस्या को हल कर दिया है, न ही यह गारंटी देती है कि इन संरेखित कोशिकाओं पर परीक्षण की गई प्रत्येक दवा रोगियों में काम करेगी। इसके बजाय, यह लैब और क्लिनिक के बीच के अंतर को देखने के लिए एक स्पष्ट, अधिक सटीक लेंस प्रदान करती है। शोधकर्ताओं ने अपना कोड वैज्ञानिक समुदाय के लिए उपलब्ध करा दिया है, दूसरों को इस उपकरण का उपयोग करके सेल लाइन और ट्यूमर जीव विज्ञान की विशाल, पहले से विच्छेदित दुनिया का पता लगाने के लिए आमंत्रित किया है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।