A strategy for ionic current analysis of nanopore protein readouts
تقدم هذه الورقة استراتيجية حوسبية متكاملة لتحليل إشارات التيار الأيوني للبروتين عبر المسام النانوية، تجمع بين تقنيات إزالة الضجيج، والتقسيم، والتعلم الآلي لتحقيق دقة عالية في التصنيف الثنائي القائم على الشحنة ونمذجة عبور الببتيد، على الرغم من التحديات المتمثلة في التمييز بين جميع الأحماض الأمينية العشرين.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي لبحث مسبق لم يخضع لمراجعة الأقران. وهو ليس نصيحة طبية. لا تتخذ أي قرارات تتعلق بصحتك بناءً على هذا المحتوى. اقرأ إخلاء المسؤولية الكامل
تُعد البروتينات هي "خيول العمل" في الحياة، حيث تؤدي الغالبية العظمى من المهام التي تحافظ على وظائف أجسامنا. وبينما توفر شفرتنا الوراثية المخطط لبناء هذه الجزيئات، فإن المنتج النهائي غالبًا ما يكون أكثر تعقيدًا مما توحي به التعليمات. يمكن تعديل البروتينات كيميائيًا بعد صنعها، أو طيها في أشكال ثلاثية الأبعاد معقدة، أو دمجها بطرق مختلفة لإنشاء مجموعة مذهلة من الأشكال المتمايزة. ولفهم الصحة والمرض حقًا، يحتاج العلماء إلى قراءة جزيئات البروتين الفردية هذه مباشرة، بدلاً من مجرد استنتاج وجودها من البيانات الجينية. لعقود من الزمن، سمحت تقنية تسمى "تسلسل النانو بوري" (nanopore sequencing) للباحثين بقراءة الحمض النووي (DNA) والحمض النووي الريبوزي (RNA) بدقة عالية من خلال مراقبة مرورها عبر ثقب مجهري. ومع ذلك، فقد ثبت أن تطبيق هذه التقنية نفسها على البروتينات أكثر صعوبة بكثير؛ فخلافًا للأبجدية المكونة من أربعة أحرف في الحمض النووي، تُبنى البروتينات من عشرين وحدة بناء مختلفة تسمى الأحماض الأمينية، ولكل منها خصائص فيزيائية فريدة. علاوة على ذلك، غالبًا ما تكون البروتينات مطوية وتحمل شحنات كهربائية غير متساوية، مما يخلق إشارة متشابكة يصعب فك رموزها.
لقد طور فريق من الباحثين الآن استراتيجية حوسبية جديدة لجعل الإشارات الكهربائية الناتجة عن مرور البروتينات عبر "النانو بوري" مفهومة. ويركز عملهم على طريقة محددة يعمل فيها محرك جزيئي، يعمل مثل محرك صغير، على سحب خيط البروتين عبر المسام خطوة بخخاذ واحدة. وبينما يتحرك البروتين، فإنه يعطل تدفق الكهرباء بطريقة تعتمد على نوع الأحماض الأمينية الموجودة حاليًا داخل الثقب. ويكمكن التحدي في فك تشفير هذا التيار الضوضائي والمتذبذب لتحديد تسلسل الأحماض الأمينية. قام الباحثون بإنشاء مسار (pipeline) لتنقية البيانات الخام، وتقسيمها إلى أجزاء ذات معنى، ثم استخدام نماذج حاسوبية لتحديد الأحماض الأمينية المحددة المسؤولة عن الإشارة. ووجدوا أنه بينما يظل تمييز كل حمض أميني بمفرده مهمة صعبة، فإن هذه الطريقة فعالة للغاية في التمييز بين مجموعات الأحماض الأمينية بناءً على شحنتها الكهربائية.
بدأت الدراسة بمجموعة من خيوط البروتين الاصطناعية المصممة خصيصًا لاختبار هذه التقنية. تم هندسة هذه الخيوط لتحتوي على أقسام متكررة، حيث يحمل كل قسم حمضًا أمينيًا فريدًا واحدًا في المنتصف، تفصل بينها علامات تخلق انخفاضًا متميزًا في الإشارة الكهربائية. سمح هذا التصميم للباحثين بعزل الإشارة الناتلة عن الأحماض الأمينية الفردية. أولاً، كان عليهم تنظيف البيانات الكهربائية الخام، التي كانت مليئة بالضوضاء العشوائية التي قد تخفي الإشارة البيولوجية الحقيقية. استخدموا عملية متعددة الخطوات لإزالة هذه الشوائب مع الحفاظ على التحولات الحادة التي تميز حركة البروتين. وبمجرد تنظيف البيانات، احتاجوا إلى معرفة أين تنتهي إشارة حمض أميني معين وأين تبدأ الإشارة التالية. اختبروا نهجين رياضيين مختلفين لتحديد هذه الحدود؛ حيث اكتشف أحد النهجين التغيرات في الإشارة تلقائيًا، بينما فرض النهج الآخر تقسيم البيانات إلى عدد ثابت من القطع لضمان الاتساق. أنتج كلا النهجين نتائج موثوقة، حيث قسما رحلة البروتين إلى حوالي خمس وثلاثين خطوة متميزة، وهو رقم يتوافق مع السرعة المعروفة للمحرك الجزيئي الذي يسحب البروتين عبر المسام.
بعد تقسيم الإشارات، انتقل الباحثون إلى مهمة التحديد. استخدموا نوعين مختلفين من نماذج التعلم الحاسوبي لتحليل الأنماط الكهربائية. تضمن النهج الأول تدريب شبكة تعلم عميق للتعرف على السمات الإحصائية داخل كل جزء، مثل متوسط التيار، ونطاق التقلبات، وشكل منحنى الإشارة. وعند مطالبتها بتحديد جميع الأحماض الأمينية العشرين في وقت واحد، واجه النموذج صعوبة، حيث بلغت دقة التحديد حوالي واحد وعشرين بالمائة فقط. تشير هذه النتيجة إلى أن التواقيع الكهربائية للعديد من الأحماض الأمينية متشابهة للغاية بحيث يصعب تمييزها عندما تتنافس الأحماض العشرين ضد بعضها البعض. ومع ذلك، كان أداء النموذج أفضل بكثير عندما طُلب منه الاختيار بين حمضين أمينيين فقط في كل مرة. وفي هذه المقارنات المباشرة، ارتفع متوسط الدقة إلى حوالي خمسة وسبعين بالمائة. وقد برزت بعض الأحماض الأمينية، وخاصة تلك ذات الشحنة الكهربائية السالبة، بشكل واضح، بينما خلط النموذج كثيرًا بين الأحماض الأخرى ذات الخصائص الفيزيائية المتشابهة، مثل الحجم أو انعدام الشحنة.
استخدم النهج الثاني نوعًا مختلفًا من النماذج التي تعامل حركة البروتين كمتتالية من الخطوات، تمامًا مثل خريطة مخفية يحاول الكمبيوتر تتبعها. كان هذا النموذج جيدًا بشكل خاص في التقاط النمط العام لرحلة البروتين، بما في ذلك اللحظات التي قد ينزلق فيها المحرك للخلف أو يتوقف مؤقتًا. ومثل نموذج التعلم العميق، برع هذا النهج في التمييز بين الأحماض الأمينية الموجبة والسالبة الشحنة، محققًا دقة تزيد عن ثلاثة وتسعين بالمائة في الاختبارات الثنائية. كما أدى أداء جيدًا في فصل الأحماض الأمينية حسب حجمها العام، رغم أنه واجه صعوبة مع المجموعات متوسطة الحجم. وجد الباحثون أن الطريقة الأكثر موثوقية لقراءة هذه البروتينات لم تكن في محاولة تسمية كل حرف في التسلسل، بل في تجميعها حسب سماتها الفيزيائية الأكثر وضوحًا. وقد ثبت أن الشحنة الكهربائية للحمض الأميني هي أقوى إشارة، مما يخلق بصمة مميزة يمكن للكمبيوتر التعرف عليها بثقة عالية.
تخلص الدراسة إلى أنه بينما لا تزال قراءة تسلسل كامل للبروتين من الصفر مشكلة لم تُحل بعد، فإن هذه التقنية جاهزة للتطبيقات المستهدفة. إن القدرة على التمييز بشكل موثوق بين المناطق المشحونة وغير المشحونة، أو تحديد طفرات معينة تغير شحنة البروتين، توفر مسارًا عمليًا للمضي قدمًا. ويقترح الباحثون أن التحسينات المستقبلية ستأتي من استخدام مجموعات بيانات أكبر وتصميم خيوط بروتينية تعرض الأحماض الأمينية في سياقات أكثر تنوعًا. أما في الوقت الحالي، فإن هذا العمل يوفر أساسًا متينًا لفهم كيفية تفاعل البروتينات مع "النانو بوري". وهو يثبت أنه حتى مع البيانات المعقدة والمليئة بالضوضاء، من الممكن استخراج معلومات بيولوجية ذات معنى من خلال الجمع بين معالجة الإشارات الدقيقة والنماذج الحوسبية الذكية. إن الطريق نحو تسلسل البروتين الكامل طويل، لكن هذه الاستراتيجية تقدم منهجًا واضحًا وخطوة بخطوة للإبحار في المشهد الكهربائي للبروتيوم.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.