Application of H&E images combined with gene expression data-driven multimodal deep learning models in gastric cancer prognosis
यह अध्ययन PGC-pro को प्रस्तुत करता है, जो एक मल्टीमॉडल डीप लर्निंग मॉडल है जो एकल-मोडल दृष्टिकोणों की तुलना में गैस्ट्रिक कैंसर के रोगनिदान संबंधी सटीकता और व्याख्यात्मकता में महत्वपूर्ण सुधार करने के लिए H&E हिस्टोपैथोलॉजी छवियों, जीन अभिव्यक्ति प्रोफाइल और नैदानिक डेटा को एकीकृत करता है।
मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। यह एक ऐसे प्रीप्रिंट की AI से तैयार की गई व्याख्या है जिसकी अभी सहकर्मी समीक्षा नहीं हुई है। यह चिकित्सकीय सलाह नहीं है। इस सामग्री के आधार पर स्वास्थ्य संबंधी फैसले न लें। पूरा डिस्क्लेमर पढ़ें
गैस्ट्रिक कैंसर, जिसे अक्सर पेट का कैंसर भी कहा जाता है, दुनिया भर में सबसे कठिन स्वास्थ्य चुनौतियों में से एक बना हुआ है, जो हर साल लाखों लोगों की जान लेता है। दशकों से, डॉक्टर मरीज के भविष्य का अनुमान लगाने के लिए TNM स्टेजिंग नामक एक प्रणाली पर भरोसा करते रहे हैं। यह प्रणाली एक मानचित्र की तरह काम करती है, जो ट्यूमर के आकार और यह पास की लिम्फ नोड्स या दूर के अंगों तक कितनी दूर तक फैल गया है, इसका खाका खींचती है। हालांकि यह मानचित्र आवश्यक है, लेकिन यह अपूर्ण भी है। यह बीमारी के भौतिक विस्तार का वर्णन करता है, लेकिन अक्सर कैंसर के अद्वितीय जैविक व्यक्तित्व को छोड़ देता है। एक ही आकार और स्थान वाले ट्यूमर वाले दो रोगियों के परिणाम बहुत अलग हो सकते हैं क्योंकि उनके कैंसर सूक्ष्म स्तर पर अलग तरह से व्यवहार करते हैं। इस अंतर को पाटने के लिए, वैज्ञानिक सूचना के दो शक्तिशाली स्रोतों की ओर मुड़ रहे हैं, जिन्हें पारंपरिक रूप से अलग रखा गया है: वे दृश्य पैटर्न जो सूक्ष्मदर्शी (माइक्रोस्कोप) के नीचे देखे जाते हैं और वे आणविक निर्देश जो कोशिकाओं के भीतर लिखे होते हैं। एक स्रोत H&E स्लाइड है, जो एक मानक कांच की स्लाइड है जहाँ ऊतक (टिशू) के एक पतले स्लाइस को गुलाबी और बैंगनी रंगों से रंगा जाता है ताकि कोशिकाओं के आकार और व्यवस्था को प्रकट किया जा सके। दूसरा है जीन एक्सप्रेशन डेटा, जो एक डिजिटल रीडआउट है कि उस ट्यूमर के भीतर कौन से जीन सक्रिय हैं, जो एक आणविक फिंगरप्रिंट की तरह कार्य करता है। चुनौती इन दो बहुत ही अलग प्रकार की सूचनाओं—छवियों और संख्याओं—को एक एकल, सुसंगत चित्र में संयोजित करने की रही है जो एक डॉक्टर को सटीक रूप से बता सके कि उस विशिष्ट रोगी का कैंसर कितना खतरनाक होने की संभावना है।
हाल ही में, किंगहाई यूनिवर्सिटी एफिलिएटेड अस्पताल के शोधकर्ताओं ने इस चुनौती का सामना करने के लिए एक नए प्रकार का कंप्यूटर मॉडल बनाने के साथ इस समस्या को हल किया, जिसे दृश्य और आणविक दोनों दुनियाओं से एक साथ सीखने के लिए डिज़ाइन किया गया है। उन्होंने अपनी रचना को PGC-pro कहा, एक ऐसी प्रणाली जो न केवल ट्यूमर के आकार या उसके जीन को अलग-थलग देखती है, बल्कि यह भी अध्ययन करती है कि वे एक-दूसरे से कैसे बात करते हैं। टीम ने पेट के कैंसर के लिए उपचारित 318 रोगियों के डेटा से शुरुआत की। प्रत्येक रोगी के लिए, उन्होंने तीन चीजें एकत्र कीं: पूरे ट्यूमर स्लाइड का एक डिजिटल स्कैन, हजारों जीन कितने सक्रिय थे इसकी एक सूची, और रोगी का क्लिनिकल इतिहास, जिसमें आयु और बीमारी का चरण शामिल था। शोधकर्ताओं ने पहले कंप्यूटर को सूक्ष्मदर्शी छवियों के सबसे महत्वपूर्ण हिस्सों को पहचानना सिखाया। एक ऐसी विधि का उपयोग करते हुए जो एक रोगविज्ञानी (पैथोलॉजिस्ट) द्वारा स्लाइड को स्कैन करने की नकल करती है, सिस्टम ने खाली स्थानों को अनदेखा करना और उन भीड़भाड़ वाले क्षेत्रों पर ध्यान केंद्रित करना सीखा जहाँ कैंसर कोशिकाएं सामान्य ऊतकों पर आक्रमण कर रही थीं। साथ ही, कंप्यूटर ने आनुवंशिक डेटा को छाना ताकि उन विशिष्ट जीनों को खोजा जा सके जो रोगियों के जीवित रहने की अवधि से सबसे मजबूती से जुड़े थे, जिससे हजारों संभावनाओं को केवल 150 मुख्य जीनों के समूह तक सीमित कर दिया गया जो वास्तव में महत्वपूर्ण थे।
इस कार्य का मुख्य नवाचार यह है कि कंप्यूटर इन दो सूचना धाराओं को कैसे जोड़ता है। सूचना को केवल छवि डेटा के बगल में रखने के बजाय, मॉडल एक ऐसी प्रक्रिया का उपयोग करता है जो दोनों को एक-दूसरे से प्रश्न पूछने की अनुमति देती है। कल्पना कीजिए कि छवि डेटा जीन डेटा से पूछता है, "इस विशिष्ट कोशिकाओं के समूह में क्या आणविक परिवर्तन हो रहे हैं?" जबकि जीन डेटा छवि डेटा से पूछता है, "यह ऊतक कैसा दिखता है जहाँ ये जीन सबसे अधिक सक्रिय हैं?" यह आदान-प्रदान मॉडल को गहरे संबंधों को खोजने की अनुमति देता जिन्हें अकेला कोई भी पक्ष नहीं देख सकता था। उदाहरण के लिए, मॉडल यह सीख सकता है कि छवि में कोशिकाओं की एक विशिष्ट अव्यवस्थित व्यवस्था लगभग हमेशा कुछ जीनों की उच्च गतिविधि के साथ जुड़ी होती है, और यह विशिष्ट संयोजन खराब परिणाम के लिए एक मजबूत चेतावनी संकेत है। रोगी की आयु और बीमारी के चरण के साथ इन दृश्य और आणविक संकेतों को एकीकृत करके, मॉडल प्रत्येक व्यक्ति के लिए एक एकल जोखिम स्कोर उत्पन्न करता है।
इस दृष्टिकोण के परिणाम स्पष्ट और मापने योग्य थे। जब शोधकर्ताओं ने रोगी डेटा पर मॉडल का परीक्षण किया, तो यह केवल एक प्रकार की जानकारी का उपयोग करने वाले किसी भी अन्य तरीके की तुलना में जीवित रहने की भविष्यवाणी करने में काफी बेहतर साबित हुआ। केवल जीन देखने वाला एक मॉडल एक निश्चित स्तर की सटीकता के साथ परिणामों की भविष्यवाणी कर सकता था, और केवल छवियों को देखने वाला मॉडल थोड़ा कम प्रभावी था, लेकिन संयुक्त मॉडल दोनों से बेहतर प्रदर्शन करता है। सिस्टम ने एक ऐसा स्कोर प्राप्त किया जो मृत्यु के जोखिम के आधार पर रोगियों को सही ढंग से रैंक करने की उच्च क्षमता को दर्शाता है, जो तीनों डेटा स्रोतों का एक साथ उपयोग करने पर उल्लेखनीय रूप से बढ़ गया। इससे भी महत्वपूर्ण बात यह है कि मॉडल एक रहस्यमय "ब्लैक बॉक्स" की तरह काम नहीं करता जो बिना स्पष्टीकरण के उत्तर देता है। शोधकर्ताओं ने इसमें ऐसे उपकरण बनाए हैं जो उन्हें यह देखने की अनुमति देते हैं कि कंप्यूटर वास्तव में क्या देख रहा है। वे 'हीट मैप्स' उत्पन्न कर सकते थे जो दिखा सकते थे कि मॉडल ट्यूमर स्लाइड के किन हिस्सों पर ध्यान केंद्रित कर रहा था, और इन मानचित्रों ने लगातार ट्यूमर के किनारों को उजागर किया जहाँ यह स्वस्थ ऊतकों पर आक्रमण कर रहा था, साथ ही मृत कोशिकाओं वाले क्षेत्रों को भी। वे यह भी देख सकते थे कि कौन से जीन भविष्यवाणी को संचालित कर रहे थे, जिससे उन विशिष्ट आणविक मार्करों की पहचान हुई जिन्हें मॉडल ने महत्वपूर्ण माना था। यह पारदर्शिता अत्यंत महत्वपूर्ण है, क्योंकि यह डॉक्टरों को जैविक साक्ष्य देखकर कंप्यूटर के निर्णय पर भरोसा करने की अनुमति देती है।
अध्ययन ने यह भी परीक्षण किया कि मॉडल समय के साथ कितनी अच्छी तरह से भविष्यवाणियां कर सकता है। इसने एक, तीन और पांच वर्षों में जीवित रहने की संभावनाओं का सफलतापूर्वक अनुमान लगाया, और विभिन्न समय सीमाओं में अपनी सटीकता बनाए रखी। जब रोगियों को मॉडल के स्कोर के आधार पर उच्च-जोखिम और निम्न-जोखिम समूहों में विभाजित किया गया, तो उनके वास्तविक जीवित रहने की दर में अंतर स्पष्ट और सांख्यिकीय रूप से महत्वपूर्ण था, जो पुष्टि करता है कि मॉडल प्रभावी रूप से उन लोगों को अलग कर सकता है जो अच्छा करेंगे और उन्हें जो नहीं करेंगे। शोधकर्ताओं ने उल्लेख किया कि हालांकि मॉडल ने अच्छा प्रदर्शन किया, लेकिन इसे रोगियों के एकल डेटाबेस पर प्रशिक्षित किया गया था, और विभिन्न अस्पतालों या क्षेत्रों के रोगियों पर इसके काम करने की क्षमता का अभी भी परीक्षण किया जाना बाकी है। उन्होंने यह भी स्वीकार किया कि उपयोग की गई छवियों में कभी-कभी खामियां थीं, जैसे असमान स्टेनिंग, जो कंप्यूटर के दृश्य को प्रभावित कर सकती है। इन सीमाओं के बावजूद, यह कार्य प्रदर्शित करता है कि ट्यूमर की दृश्य कहानी को उसकी आणविक कहानी के साथ जोड़ने से बीमारी को समझने के लिए एक बहुत अधिक शक्तिशाली उपकरण बनता है। यह सिद्ध करके कि इस प्रकार के विभिन्न डेटा को एक स्पष्ट चित्र प्रकट करने के लिए एक साथ बुना जा सकता है, यह शोध गैस्ट्रिक कैंसर का सामना कर रहे रोगियों के लिए अधिक व्यक्तिगत और सटीक देखभाल की दिशा में एक आशाजनक मार्ग प्रदान करता है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।