← नवीनतम पेपर
🧬 biology

spaGFM is a scalable graph foundation model for spatial transcriptomics analyses

यह शोध पत्र spaGFM को प्रस्तुत करता है, जो एक स्केलेबल ग्राफ फाउंडेशन मॉडल है जो स्थानिक ट्रांसक्रिप्टोमिक्स (spatial transcriptomics) डेटा के सुदृढ़ और हस्तांतरणीय निरूपण (representations) उत्पन्न करने के लिए रैंडम वॉक और स्व-पर्यवेक्षित शिक्षण (self-supervised learning) का लाभ उठाता है, जिससे विविध जैविक संदर्भों में जटिल ऊतक संगठन और कार्यात्मक परिणामों का विश्लेषण सक्षम होता है।

मूल लेखक: Juexin Wang, Yu Zhong, Fei He, Xiaojie Jin, Yang Yu, Ricardo Melo Ferreira, Andrew Gunderson, Jordan Krull, Guangyu Wang, Michael Eadon, Qin Ma, Dong Xu

प्रकाशित 2026-09-18
📖 7 मिनट में पढ़ें🧠 गहराई से पढ़ें

मूल लेखक: Juexin Wang, Yu Zhong, Fei He, Xiaojie Jin, Yang Yu, Ricardo Melo Ferreira, Andrew Gunderson, Jordan Krull, Guangyu Wang, Michael Eadon, Qin Ma, Dong Xu

मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। ⚕️ यह एक ऐसे प्रीप्रिंट की AI से तैयार की गई व्याख्या है जिसकी अभी सहकर्मी समीक्षा नहीं हुई है। यह चिकित्सकीय सलाह नहीं है। इस सामग्री के आधार पर स्वास्थ्य संबंधी फैसले न लें। पूरा डिस्क्लेमर पढ़ें

जीव विज्ञान लंबे समय से ऊतक के एक टुकड़े को सूक्ष्मदर्शी (माइक्रोस्कोप) के नीचे रखकर उसमें कोशिकाओं की गिनती करने पर निर्भर रहा है, लेकिन यह दृष्टिकोण अक्सर व्यापक तस्वीर को देखने में चूक जाता है। एक एकल कोशिका शून्य में अस्तित्व में नहीं रहती; उसका व्यवहार इस बात से निर्धारित होता है कि उसके साथ कौन रहता है। एक जीवित अंग में, एक कोशिका का कार्य इस पर निर्भर करता है कि वह अपने बगल में ऐसे पड़ोसी के साथ बैठी है जो संक्रमण से लड़ रहा है या ऐसे के साथ जो चुपचाप क्षति की मरम्मत कर रहा है। ऊतक कैसे काम करते हैं, और बीमारी में वे क्यों विफल होते हैं, इसे समझने के लिए वैज्ञानिकों को न केवल व्यक्तिगत खिलाड़ियों को देखने की आवश्यकता है, बल्कि उन जटिल, बदलते पड़ोसों को भी देखने की आवश्यकता है जो वे बनाते हैं। हाल के वर्षों में, 'स्पेशियल ट्रांसक्रिप्टोमिक्स' नामक एक नई तकनीक ने यह संभव बना दिया है, जो एक ऊतक नमूने के भीतर प्रत्येक जीन कहाँ सक्रिय है, इसका सटीक मानचित्र तैयार करती है, जिससे उसके निवासियों की सूची के साथ उस पड़ोस का मानचित्र भी सुरक्षित रहता है। हालाँकि, ये मानचित्र इतने विशाल और विस्तृत होते जा रहे हैं कि कंप्यूटर के लिए इन्हें पढ़ना कठिन हो रहा है। यह डेटा शब्दों की एक साधारण सूची या कोड की एक सीधी रेखा नहीं है; यह कनेक्शनों का एक उलझा हुआ जाल है, जहाँ कोशिकाओं से अधिक महत्वपूर्ण उनके बीच की दूरी और संबंध होते हैं।

शोधकर्ताओं की एक टीम ने 'spaGFM' नामक एक नया उपकरण पेश किया है, जिसे इन जटिल कोशिकीय पड़ोसों को समझने के लिए डिज़ाइन किया गया है। इसे एक ऐसे सिस्टम के रूप में समझें जो केवल कोशिकाओं को अलग-अलग देखने के बजाय, उनके बीच के पथों का पता लगाकर ऊतक की कहानी पढ़ने में सक्षम होता है। शोधकर्ताओं ने इस सिस्टम को डेटा के एक विशाल संग्रह पर प्रशिक्षित किया, जिसमें 132 विभिन्न ऊतक नमूनों से प्राप्त जानकारी शामिल थी जिनमें लगभग 4.4 करोड़ कोशिकाएं थीं। ये नमूने मानव और चूहे के शरीर के विभिन्न हिस्सों से आए थे, जिनमें फेफड़े, यकृत और मस्तिष्क शामिल हैं, और इन्हें विभिन्न उच्च-रिज़ॉल्यूशन वाली इमेजिंग मशीनों का उपयोग करके कैप्चर किया गया था। इस विशाल पुस्तकालय का अध्ययन करके, सिस्टम ने यह पहचानना सीखा कि कोशिकाएं कार्यात्मक समूहों में खुद को कैसे व्यवस्थित करती हैं। यह इसे एक जुड़े हुए बिंदुओं के मानचित्र के रूप में मानकर करता है, जहाँ प्रत्येक बिंदु एक कोशिका है। पूरे मानचित्र को एक साथ संसाधित करने के बजाय, सिस्टम मानचित्र पर "भ्रमण" (walks) करता है, एक कोशिका से उसके पड़ोसी पर, और फिर उस पड़ोसी के पड़ोसी पर कूदता है। यह इन यात्राओं को कदमों के एक क्रम के रूप में रिकॉर्ड करता है, जिससे यह किसी भी दी गई कोशिका के स्थानीय वातावरण को समझने में सक्षम होता है, उसके तत्काल परिवेश से लेकर उस व्यापक पड़ोस तक जिसमें वह निवास करती है।

इस दृष्टिकोण की शक्ति का परीक्षण तीन बहुत ही अलग जैविक चुनौतियों में किया गया, जिनमें से प्रत्येक ने यह प्रकट किया कि सिस्टम ने नई स्थितियों में क्या सीखा। सबसे पहले, शोधकर्ताओं ने पूछा कि क्या सिस्टम विशिष्ट प्रतिरक्षा संरचनाओं को खोज सकता है जिन्हें 'टर्शियरी लिम्फोइड स्ट्रक्चर्स' कहा जाता है। ये प्रतिरक्षा कोशिकाओं के छोटे, संगठित समूह हैं जो पुराने सूजन या कैंसर के दौरान ऊतकों में बनते हैं, और उनकी उपस्थिति अक्सर यह भविष्यवाणी करती है कि रोगी उपचार के प्रति कितनी अच्छी तरह प्रतिक्रिया देगा। इनकी पहचान करना अत्यंत कठिन है, विशेष रूप से पुराने, कम-रिज़ॉल्यूशन वाले इमेजिंग डेटा में जहाँ कोशिकाओं के बीच की सीमाएं धुंधली होती हैं। उच्च-रिज़ॉल्यूशन वाली छवियों पर प्रशिक्षित होने के कारण, सिस्टम सफलतापूर्वक फेफड़े और किडनी कैंसर के निम्न-रिज़ॉल्यूशन वाले डेटा में इन संरचनाओं का पता लगाने में सक्षम रहा। इसने नए डेटा पर पुन: प्रशिक्षित होने की आवश्यकता के बिना, केवल उन स्थानिक पैटर्न को पहचानकर ऐसा किया जो इसने पहले सीखे थे। परिणामों ने दिखाया कि सिस्टम पिछले तरीकों की तुलना में इन प्रतिरक्षा समूहों को आसपास के ट्यूमर ऊतक से अधिक सटीकता से अलग कर सकता है, भले ही डेटा पूरी तरह से अलग प्रकार की मशीन से आया हो।

इसके बाद, टीम ने यह पता लगाया कि सिस्टम कैंसर कोशिकाओं पर प्रतिरक्षा वातावरण के प्रभाव को कैसे समझता है। चूहे के ट्यूमर पर किए गए आनुवंशिक प्रयोगों के एक अध्ययन में, शोधकर्ताओं ने पहले ही कैंसर कोशिकाओं में विशिष्ट जीन को बदलकर यह देखा था कि वे कैसे प्रतिक्रिया करती हैं। प्रश्न यह था कि क्या कैंसर कोशिका की प्रतिक्रिया इस बात पर निर्भर करती है कि वह टी-सेल (एक प्रकार की प्रतिरक्षा कोशिका) के पास खड़ी है या दूर। सिस्टम कैंसर कोशिकाओं में आनुवंशिक परिवर्तनों को देख सका और सही ढंग से भविष्यवाणी कर सका कि कौन सी कोशिकाएं टी-सेल्स के करीब थीं और कौन सी दूर, केवल उनकी जीन गतिविधि के पैटर्न का विश्लेषण करके। इससे भी महत्वपूर्ण बात यह है कि यह एक ऐसी आनुवंशिक परिवर्तन के प्रति प्रतिक्रिया की भविष्यवाणी कर सका जिसे इसने पहले कभी नहीं देखा था, लेकिन केवल तभी जब वह प्रतिक्रिया एक प्रतिरक्षा कोशिका की निकटता पर निर्भर थी। यह सुझाव देता है कि सिस्टम ने वास्तव में यह सीखा है कि कोशिकाएं अपने पड़ोसियों से कैसे बात करती हैं, न कि केवल जीन व्यवहारों की एक सूची को रटा है।

अंत में, शोधकर्ताओं ने इस उपकरण को मधुमेह संबंधी किडनी रोग (डायबिटिक किडनी डिजीज) वाले एक रोगी के मानव किडनी बायोप्सी पर लागू किया। इस स्थिति में, किडनी की छोटी फ़िल्टरिंग इकाइयाँ, जिन्हें ग्लोमेरुली कहा जाता है, क्षतिग्रस्त और स्कार (निशान) हो जाती हैं। पैथोलॉजिस्ट दृष्टिगत रूप से इस क्षति को हल्के से गंभीर स्तर तक ग्रेड देते हैं, लेकिन इसे आंखों से करना कठिन और व्यक्तिपरक है। सिस्टम इस ऊतक को देख सका और कोशिकाओं को स्वचालित रूप से सही क्षति श्रेणियों में वर्गीकृत कर सका, जो मानव विशेषज्ञों द्वारा दिए गए ग्रेड से मेल खाता था। इसने उन नए क्षेत्रों की भी पहचान की जो क्षतिग्रस्त ग्लोमेरुली जैसे दिखते थे लेकिन प्रारंभिक मानव समीक्षा में छूट गए थे, जिनकी बाद में विशिष्ट आणविक मार्करों की उपस्थिति से पुष्टि हुई। सिस्टम ने यह भी प्रकट किया कि जैसे-जैसे क्षति बढ़ती है, पड़ोस की संरचना अनुमानित तरीकों से बदल जाती है, जिसमें कुछ सुरक्षात्मक कोशिकाएं गायब हो जाती हैं और अन्य उनका स्थान ले लेती हैं।

इस कार्य का महत्व इसकी क्षमता को स्केल करने की शक्ति में निहित है। इन कोशिकीय मानचित्रों के विश्लेषण के लिए पिछले तरीके अक्सर संघर्ष करते थे जब डेटा बहुत बड़ा या जटिल हो जाता था, क्योंकि वे कनेक्शनों की भारी संख्या के कारण धीमे पड़ जाते थे। यह नया दृष्टिकोण कोशिका-से-कोशिका कनेक्शनों के जटिल जाल को एक ऐसे प्रारूप में बदलकर उन सीमाओं को पार करता है जिसे आधुनिक कंप्यूटर कुशलतापूर्वक संसाधित कर सकें। यह वैज्ञानिकों को यह सीखने की अनुमति देता है कि ऊतक कैसे निर्मित होते हैं और वे कैसे विफल होते हैं, ऐसे नियम जो विभिन्न अंगों और विभिन्न रोगों में सत्य रहते हैं। हालांकि यह सिस्टम मानव विशेषज्ञों को बदलने वाला कोई जादुई समाधान नहीं है, लेकिन यह सूक्ष्म दुनिया को देखने के लिए एक शक्तिशाली नया लेंस प्रदान करता है। यह अरबों कोशिकाओं के अराजक जमावड़े को संगठन की एक पठनीय कहानी में बदल देता है, जो जीवन और रोग के मौलिक सिद्धांतों को समझने के लिए एक स्पष्ट मार्ग प्रदान करता है।

अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?

आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।

Digest आज़माएँ →