spaGFM is a scalable graph foundation model for spatial transcriptomics analyses
تقدم الورقة البحثية spaGFM، وهو نموذج رسومي أساسي قابل للتوسع يستفيد من المسارات العشوائية والتعلم الخاضع للإشراف الذاتي لتوليد تمثيلات قوية وقابلة للنقل لبيانات النسخ المكاني، مما يتيح تحليل التنظيم النسيجي المعقد والتبعات الوظيفية عبر سياقات بيولوجية متنوعة.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي لبحث مسبق لم يخضع لمراجعة الأقران. وهو ليس نصيحة طبية. لا تتخذ أي قرارات تتعلق بصحتك بناءً على هذا المحتوى. اقرأ إخلاء المسؤولية الكامل
لطالما اعتمد علم الأحياء على فحص قطعة من الأنسجة عبر المجهر وعدّ الخلايا التي يراها، لكن هذا النهج غالبًا ما يغفل الصورة الأكبر. فالخلية الواحدة لا تعيش في فراغ؛ إذ يتحدد سلوكها بناءً على الرفقة التي تحيط بها. ففي عضو حي، يتغير وظيفة الخلية اعتمادًا على ما إذا كانت تجلس بجوار جارٍ يقاتل عدوى أو آخر يقوم بهدوء بإصلاح التلف. ولفهم كيفية عمل الأنسجة، ولماذا تفشل في حالات المرض، يحتاج العلماء ليس فقط لرؤية اللاعبين الأفراد، بل لرؤية الأحياء السكنية المعقدة والمتغيرة التي يشكلونها. وفي السنوات الأخيرة، جعلت تقنية جديدة تسمى "علم النسخ المكاني" (spatial transcriptomics) هذا الأمر ممكنًا عبر رسم خريطة دقيقة لمكان تنشيط كل جين داخل عينة نسيجية، مما يحافظ على خريطة الحي السكني إلى جانب قائمة سكانها. ومع ذلك، أصبحت هذه الخرائط ضخمة ومفصلة للغاية لدرجة يصعب معها على الحواسيب قراءتها؛ فالبيانات ليست مجرد قائمة بسيكلة من الكلمات أو خط مستقيم من الشفرة البرمجية، بل هي شبكة متشابكة من الروابط، حيث تهم المسافة والعلاقة بين الخلايا أكثر من الخلايا نفسها.
قدم فريق من الباحثين أداة جديدة تسمى "spaGFM"، صُممت لفهم هذه الأحياء الخلوية المعقدة. تخيلها كنظام يتعلم قراءة قصة النسيج من خلال تتبع المسارات بين خلاياه، بدلاً من مجرد النظر إليها كعناصر معزولة. قام الباحثون بتدريب هذا النظام على مجموعة هائلة من البيانات، حيث غدّوه بمعلومات من 132 عينة نسيجية مختلفة تحتوي على ما يقرب من 44 مليون خلية. جاءت هذه العينات من أجزاء مختلفة من جسم الإنسان والفأر، بما في ذلك الرئة والكبد والدماغ، وتم التقاطها باستخدام آلات تصوير مختلفة عالية الدقة. ومن خلال دراسة هذه المكتبة الضخمة، تعلم النظام التعرف على الأنماط التي تنظم بها الخلايا نفسها في مجموعات وظيفية. وهو يفعل ذلك عبر معاملة النسيج كخريطة من النقاط المتصلة، حيث تمثل كل نقطة خلية. وبدلاً من محاولة معالجة الخريطة بأكملها دفعة واحدة، يقوم النظام بـ "جولات مشي" عبر الخريطة، منتقلاً من خلية إلى جارتها، ثم إلى جارة تلك الجارة. وهو يسجل هذه الرحلات كسلسلة من الخطوات، مما يسمح له بفهم البيئة المحلية لأي خلية معينة، بدءًا من محيطها المباشر وصولاً إلى الحي الأوسع الذي تسكنه.
تم اختبار قوة هذا النهج في ثلاثة تحديات بيولوجية مختلفة تمامًا، كشف كل منها مدى قدرة النظام على تطبيق ما تعلمه في مواقف جديدة. أولاً، سأل الباحثون عما إذا كان بإمكان النظام العثور على هياكل مناعية محددة تُعرف باسم "الهياكل اللمفاوية الثالثية". هذه الهياكل هي عناقيد منظمة من الخلايا المناعية تتشكل في الأنسجة أثناء الالتهاب المزمن أو السرطان، وغالبًا ما يتنبأ وجودها بمدى استجابة المريض للعلاج. ويعد تحديدها أمرًا صعبًا للغاية، خاصة في بيانات التصوير الأقدم والأقل دقة حيث تكون الحدود بين الخلايا ضبابية. وقد تمكن النظام، الذي تم تدريبه فقط على صور عالية الدقة، من تحديد موقع هذه الهياكل بنجاح في بيانات أقل دقة من عينات سرطان الرئة والكلية. فعل ذلك دون الحاجة لإعادة تدريبه على البيانات الجديدة، ببساطة عن طريق التعرف على الأنماط المكانية التي تعلمها سابقًا. وأظهرت النتائج أن النظام يمكنه تمييز هذه العناقيد المناعية عن أنسجة الورم المحيطة بدقة أكبر من الطرق السابقة، حتى عندما جاءت البيانات من نوع مختلف تمامًا من الآلات.
بعد ذلك، استكشف الفريق كيف يفهم النظام تأثير البيئة المناعية على الخلايا السرطانية. في دراسة تضمنت تجارب جينية على أورام الفئران، كان الباحثون قد عدلوا بالفعل جينات معينة في الخلايا السرطانية لمعرفة كيفية تفاعلها. وكان السؤال هو ما إذا كان تفاعل الخلية السرطانية يعتمد على ما إذا كانت تقف بجوار خلية تائية (T-cell)، وهي نوع من الخلايا المناعية. استطاع النظام النظر في التغيرات الجينية في الخلايا السرطانية والتنبؤ بشكل صحيح أي منها كان قريبًا من الخلايا التائية وأيها كان بعيدًا، وذلك بمجرد تحليل الأنماط في نشاطها الجيني. والأهم من ذلك، كان بإمكانه التنبؤ بكيفية تفاعل الخلية السرطانية مع تغير جيني لم يره من قبل، ولكن بشرط أن يعتمد ذلك التفاعل على قربها من خلية مناعية. وهذا يشير إلى أن النظام قد تعلم حقًا قواعد كيفية تواصل الخلايا مع جيرانها، بدلاً من مجرد حفظ قائمة بسلوكيات الجينات.
أخيرًا، طبق الباحثون هذه الأداة على خزعة كلى بشرية لمريض يعاني من مرض الكلى السكري. في هذه الحالة، تتعرض وحدات الترشيح الصغيرة في الكلية، والتي تسمى الكبيبات، للتلف والندبات. يقوم أطباء المسالك البولية بتصنيف هذا التلف من بسيط إلى شديد، لكن القيام بذلك بالعين المجردة أمر صعب وغير موضوعي. استطاع النظام النظر في النسيج وتجميع الخلايا تلقائيًا في فئات الضرر الصحيحة، مطابقةً الدرجات التي حددها الخبراء البشريون. بل إنه حدد مناطق جديدة تبدو وكأنها كبيبات متضررة ولكن فات خبراء البشر ملاحظتها، والتي تأكدت لاحقًا بوجود علامات جزيئية محددة. كما كشف النظام أنه مع تفاقم الضرر، يتغير تكوين الحي السكني بطرق يمكن التنبؤ بها، حيث تختفي خلايا وقائية معينة وتحل محلها خلايا أخرى.
تكمن أهمية هذا العمل في قدرته على التوسع. فغالبًا ما كانت الطرق السابقة لتحليل هذه الخرائط الخلوية تعاني عندما تصبح البيانات كبيرة جدًا أو معقدة للغاية، حيث تتعثر بسبب العدد الهائل من الاتصالات. يتجاوز هذا النهج الجديد تلك الحدود عبر تحويل الشبكة المعقدة من اتصالات خلية لخلية إلى تنسيق يمكن للحواسيب الحديثة معالجته بكفاءة. وهو يسمح للعلماء بتعلم قواعد عامة حول كيفية بناء الأنسجة وكيفية انهيارها، وهي قواعد تظل صالحة عبر أعضاء وأمراض مختلفة. وبينما لا يعد النظام حلاً سحريًا يحل محل الخبراء البشريين، فإنه يوفر عدسة قوية لرؤية العالم المجهري. فهو يحول الفوضى العارمة لمليارات الخلايا إلى قصة منظمة قابلة للقراءة، مما يوفر مسارًا أوضح لفهم المبادئ الأساسية للحياة والمرض.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.