Shetti-AI: Precise prediction of protein sequence mutational landscapes to accelerate functional assays
शेट्टी-AI (Shetti-AI) एक कम्प्यूटेशनल ढांचा है जो प्रोटीन उत्परिवर्तनीय परिदृश्यों (protein mutational landscapes) की भविष्यवाणी करने और अनुकूलित मोटिफ-समान वेरिएंट्स को उत्पन्न करने के लिए भौतिक-रासायनिक गुणों, आनुवंशिक दूरियों और जनरेटिव एडवरसेरियल नेटवर्क को एकीकृत करता है, जिससे सिंथेटिक बायोलॉजी और वायरोलॉजी में कार्यात्मक परीक्षणों में तेजी आती है और प्रयोगात्मक खोज स्थानों में कमी आती है।
मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। यह एक ऐसे प्रीप्रिंट की AI से तैयार की गई व्याख्या है जिसकी अभी सहकर्मी समीक्षा नहीं हुई है। यह चिकित्सकीय सलाह नहीं है। इस सामग्री के आधार पर स्वास्थ्य संबंधी फैसले न लें। पूरा डिस्क्लेमर पढ़ें
प्रोटीन जीवन के कार्यवाहक हैं, जो अमीनो एसिड की श्रृंखलाओं से बनी छोटी मशीनें हैं जो विशिष्ट कार्यों को करने के लिए जटिल आकृतियों में मुड़ती हैं। इन लंबी श्रृंखलाओं के भीतर, केवल कुछ अमीनो एसिड के छोटे अनुक्रम अक्सर महत्वपूर्ण स्विच या डॉकिंग पॉइंट के रूप में कार्य करते हैं, जिन्हें 'मोटिफ' (motifs) कहा जाता है। ये छोटे क्षेत्र निर्धारित करते हैं कि एक प्रोटीन अन्य अणुओं के साथ कैसे परस्पर क्रिया करता है, और इन अक्षरों में से एक में एक भी बदलाव प्रोटीन के पूरे व्यवहार को बदल सकता है। वैज्ञानिक लंबे समय से जानते हैं कि एक प्रोटीन को समझने के लिए, उन्हें इन मोटिफ्स को समझना होगा। हालांकि, प्रयोगशाला में इन लघु अनुक्रमों के हर संभावित बदलाव का परीक्षण करना एक धीमा, महंगा और अक्सर असंभव कार्य है। संभावित परिवर्तनों का स्थान इतना विशाल है कि इसे हाथ से खोजना संभव नहीं है, जिससे शोधकर्ता केवल यह अनुमान लगाते हैं कि कौन से बदलाव काम करेंगे और कौन से विफल होंगे।
इसे हल करने के लिए, हाइथम सोभी नामक एक शोधकर्ता ने 'शेट्टी-एआई' (Shetti-AI) नामक एक नया कम्प्यूटेशनल टूल विकसित किया है। यह प्रणाली यह भविष्यवाणी करने के लिए डिज़ाइन की गई है कि प्रोटीन के छोटे मोटिफ्स में कौन से बदलाव सफल होने की संभावना रखते हैं, इससे पहले कि कोई वैज्ञानिक प्रयोगशाला में प्रवेश करे। केवल इस बात पर निर्भर रहने के बजाय कि प्रकृति ने अतीत में प्रोटीनों को कैसे विकसित किया है, शेट्टी-एआई इस बात का पूर्वानुमान लगाता है कि एक प्रोटीन भविष्य में कैसे बदल सकता है। यह एक ज्ञात, काम करने वाले मोटिफ से शुरू होता है और नए, समान उम्मीदवारों की एक सूची तैयार करता है। यह प्रणाली दो मुख्य कारकों के बीच संतुलन बनाकर ऐसा करती है: कोशिका के जेनेटिक कोड के लिए परिवर्तन करना कितना आसान है, और नए अमीनो एसिड प्रोटीन के कार्य करने के लिए आवश्यक भौतिक गुणों को कितनी अच्छी तरह सुरक्षित रखते हैं। अकल्पनीय विकल्पों को बाहर करके और सबसे आशाजनक विकल्पों को उजागर करके, इस उपकरण का लक्ष्य विशाल खोज स्थान को प्रयोगों की एक प्रबंधनीय सूची तक सीमित करना है।
यह शोध पत्र जीव विज्ञान में उपयोग किए जाने वाले वर्तमान आर्टिफिशियल इंटेलिजेंस टूल्स की एक विशिष्ट समस्या पर प्रकाश डालता है। कई आधुनिक प्रोग्राम, जिन्हें अक्सर प्रोटीन लैंग्वेज मॉडल कहा जाता है, विशाल जेनेटिक डेटा में सामान्य पैटर्न पहचानने में उत्कृष्ट होते हैं। हालांकि, वे इन छोटे मोटिफ्स के सूक्ष्म विवरणों को समझने में संघर्ष करते हैं। उदाहरण के लिए, ये उपकरण दो बहुत अलग अनुक्रमों को लगभग समान मान सकते हैं क्योंकि वे व्यापक स्तर पर समान दिखते हैं, भले ही उनमें एक छोटा सा बदलाव प्रोटीन की अपने लक्ष्य से जुड़ने की क्षमता को पूरी तरह से नष्ट कर दे। लेखक बताते हैं कि मौजूदा उपकरण अक्सर अमीनो एसिड के बीच सूक्ष्म भौतिक अंतरों को पकड़ने में चूक जाते हैं, जैसे कि एक आवेशित कण (charged particle) को तटस्थ (neutral) कण से बदलना, जो प्रोटीन के कार्य को पूरी तरह से नष्ट कर सकता है। शेट्टी-एआई को विशेष रूप से इस कमी को ठीक करने के लिए बनाया गया था, जिसका ध्यान उन सटीक भौतिक और जेनेटिक नियमों पर है जो इन छोटे, महत्वपूर्ण क्षेत्रों को नियंत्रित करते हैं।
यह ढांचा पहले एक प्रमाणित मोटिफ (एक छोटा अनुक्रम जो प्रकृति में काम करने के लिए जाना जाता है) को लेकर उसके गुणों को एक विस्तृत संख्यात्मक प्रोफाइल में मैप करता है। यह प्रोफाइल अमीनो एसिड की अठारह विभिन्न भौतिक विशेषताओं पर विचार करता है, जैसे कि उनका आकार, आवेश और पानी के साथ उनकी अंतःक्रिया। प्रणाली फिर नए रूपांतरों को उत्पन्न करने के लिए गणितीय मॉडलों की एक श्रृंखला का उपयोग करती है। सिस्टम का एक हिस्सा एक रूढ़िवादी फिल्टर के रूप में कार्य करता है, यह जाँचता है कि क्या एक एकल परिवर्तन जेनेटिक रूप से सुलभ है और मूल के भौतिक रूप से समान है। दूसरा हिस्सा एक अधिक उन्नत, जनरेटिव दृष्टिकोण का उपयोग करता है जो अमीनो एसिड के पूरी तरह से नए संयोजनों की कल्पना करता है जो शायद प्रकृति में मौजूद नहीं हैं लेकिन फिर भी भौतिकी के नियमों का पालन करते हैं। इन उत्पन्न उम्मीदवारों को एक स्कोर के आधार पर रैंक किया जाता है जो उनके काम करने की संभावना और उन्हें जेनेटिक रूप से बनाने की कठिनाई के बीच संतुलन बनाता है।
सिस्टम का परीक्षण करने में, शोधकर्ताओं ने मानव प्रोटीनों को नियंत्रित करने वाले एक ज्ञात मोटिफ का बेंचमार्क के रूप में उपयोग किया। उपकरण ने सफलतापूर्वक उन विविधताओं की पहचान की जो प्रकृति में कार्य करने के लिए जानी जाती हैं, जैसे कि वे अनुक्रम जो केवल एक या दो अक्षरों से भिन्न होते हैं लेकिन समान आकार और व्यवहार बनाए रखते हैं। इससे भी महत्वपूर्ण बात यह है कि सिस्टम के जनरेटिव भाग ने नए, मौलिक अनुक्रमों का सुझाव दिया जो मूल मोटिफ के समान भौतिक गुणों को साझा करते हैं। एक नियंत्रण अनुक्रम की तुलना में, जो कि अलग होने के लिए जाना जाता था, उपकरण ने सही ढंग से पहचाना कि नए उम्मीदवार काम करने वाले मूल के बहुत करीब थे। परिणामों ने दिखाया कि जबकि कुछ मॉडल छोटे, सुरक्षित बदलाव खोजने में बेहतर थे, अन्य अधिक दूरगामी संभावनाओं की खोज करने में सक्षम थे, जो शोधकर्ता की आवश्यकता के आधार पर विकल्पों की एक विस्तृत श्रृंखला प्रदान करते हैं।
शोध पत्र सुझाव देता है कि यह दृष्टिकोण उभरते हुए वायरस के अध्ययन के लिए विशेष रूप से उपयोगी हो सकता है, जहाँ वैज्ञानिकों के पास नए वेरिएंट का परीक्षण करने के लिए बहुत कम समय होता है। एक संबंधित वायरस से ज्ञात मोटिफ को शुरुआती बिंदु के रूप में उपयोग करके, उपकरण प्रयोगशाला में परीक्षण करने योग्य संभावित उम्मीदवारों की एक सूची तेजी से तैयार कर सकता है, जिससे खोज प्रक्रिया तेज हो जाती है। यह सिंथेटिक बायोलॉजी के लिए कस्टम प्रोटीन डिजाइन करने का एक तरीका भी प्रदान करता है, जिससे शोधकर्ता हजारों विफल संस्करणों को संश्लेषित किए बिना विशिष्ट भौतिक गुणों वाले नए उपकरण बना सकते हैं। लेखक नोट करते हैं कि सिस्टम लचीला है; शोधकर्ता सेटिंग्स को बहुत सख्त बना सकते हैं, केवल उन परिवर्तनों की तलाश के लिए जो मूल के लगभग समान हैं, या अधिक खोजी (exploratory) बना सकते हैं, जो साहसी नए डिजाइनों की तलाश करते हैं।
अंततः, शेट्टी-एआई प्रयोगशाला प्रयोगों की आवश्यकता को प्रतिस्थापित नहीं करता है, बल्कि यह उनके होने के क्रम को बदल देता है। यादृच्छिक अनुमानों के परीक्षण के बजाय, वैज्ञानिक सबसे आशाजनक उम्मीदवारों को प्राथमिकता देने के लिए इस उपकरण का उपयोग कर सकते हैं, जिससे समय और संसाधनों की बचत होती है। यह प्रणाली जेनेटिक्स के कठोर नियमों और प्रोटीन डिजाइन की तरल संभावनाओं के बीच के अंतर को पाटती है, जो संभावित उत्परिवर्तन (mutations) के विशाल परिदृश्य में आत्मविश्वास के साथ नेविगेट करने का एक तरीका प्रदान करती है। केवल सांख्यिकीय पैटर्न के बजाय, प्रोटीन कैसे काम करते हैं इसके भौतिक वास्तविकता पर ध्यान केंद्रित करके, यह उपकरण यह समझने के लिए एक स्पष्ट मार्ग प्रदान करता है कि जीवन कैसे अनुकूलित होता है और हम भविष्य के लिए इसे कैसे इंजीनियर कर सकते हैं।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।