Targeted finetuning enables co-folding models to learn ligand-induced protein conformational states
यह शोध पत्र प्रदर्शित करता है कि बोलत्ज़-1 (Boltz-1) जैसे फाउंडेशन मॉडल्स की लक्षित फाइन-ट्यूनिंग (targeted finetuning), प्रशिक्षण डेटा के पूर्वाग्रहों (training data biases) को दूर करके, नवीन लिगैंड-प्रेरित प्रोटीन कन्फर्मेशनल अवस्थाओं (ligand-induced protein conformational states) और एलोस्टेरिक बाइंडिंग साइटों (allosteric binding sites) की सटीक भविष्यवाणी कर सकती है, जिससे अधिक प्रभावी ड्रग डिस्कवरी अनुप्रयोगों को सक्षम बनाया जा सकता है।
मूल पेपर CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) के तहत लाइसेंस किया गया है। यह एक ऐसे प्रीप्रिंट की AI से तैयार की गई व्याख्या है जिसकी अभी सहकर्मी समीक्षा नहीं हुई है। यह चिकित्सकीय सलाह नहीं है। इस सामग्री के आधार पर स्वास्थ्य संबंधी फैसले न लें। पूरा डिस्क्लेमर पढ़ें
द दशकों से, वैज्ञानिक केवल एक प्रोटीन के जेनेटिक कोड को देखकर उसके त्रि-आयामी (थ्री-डायमेंशनल) आकार की भविष्यवाणी करने का तरीका खोजते रहे हैं। यह कोई छोटी उपलब्धि नहीं है, क्योंकि प्रोटीन कठोर छड़ें नहीं बल्कि लचीली श्रृंखलाएं होते हैं जो अपना काम करने के लिए जटिल आकारों में मुड़ते और घूमते हैं। हाल के वर्षों में, शक्तिशाली कंप्यूटर मॉडल उभरे हैं जो इन आकारों की उल्लेखनीय सटीकता के साथ भविष्यवाणी कर सकते हैं, यहाँ तक कि जब एक प्रोटीन किसी छोटे अणु, जैसे कि दवा, से जुड़ा होता है। इन मॉडलों को अक्सर 'को-फोल्डिंग टूल्स' कहा जाता है, जिन्हें ज्ञात संरचनाओं के विशाल पुस्तकालयों पर प्रशिक्षित किया जाता है, जिससे वे इस बात के सामान्य नियम सीख पाते हैं कि प्रोटीन और अणु आपस में कैसे फिट होते हैं। हालाँकि, एक महत्वपूर्ण बाधा बनी हुई है: ये मॉडल अक्सर तब संघर्ष करते हैं जब उन्हें एक ऐसे प्रोटीन का सामना करना पड़ता है जो एक नई दवा के जवाब में अपना आकार बदल लेता है, या जब दवा प्रोटीन के उस हिस्से से जुड़ती है जिसे पहले कभी नहीं देखा गया हो। यदि कोई मॉडल इन परिवर्तनों को देख नहीं पाता है, तो वह शोधकर्ताओं को ऐसी दवाएं डिजाइन करने में मदद नहीं कर सकता जो उन पर निर्भर करती हैं, जिससे कंप्यूटर द्वारा की गई भविष्यवाणी और जीवित कोशिका में वास्तव में होने वाली घटना के बीच एक अंतर रह जाता है।
शोधकर्ताओं की एक टीम ने हाल ही में इस अंतर को यह दिखाकर संबोधित किया कि इन मॉडलों की विफलता उनके डिज़ाइन में किसी दोष के कारण नहीं, बल्कि उस डेटा में एक पूर्वाग्रह के कारण है जिस पर उन्हें सिखाया गया था। उन्होंने प्रदर्शित किया कि मॉडल को सावधानीपूर्वक कुछ विशिष्ट नए उदाहरण सिखाकर, वह जटिल, अनदेखे व्यवहारों की भविष्यवाणी करना सीख सकता है। वर्नर हेलिकेज़ (Werner helicase) नामक एक प्रोटीन की दस नई एक्स-रे छवियों का उपयोग करके, जो डीएनए मरम्मत में शामिल है और जिसे ड्रग डिस्कवरी प्रोग्राम के दौरान अध्ययन किया गया था, शोधकर्ताओं ने एक शक्तिशाली मौजूदा मॉडल को एक लक्षित पाठ दिया। उन्होंने मॉडल को दिखाया कि कैसे यह प्रोटीन एक विशिष्ट स्थान पर एक विशेष दवा के जुड़ने पर खुद को एक निष्क्रिय अवस्था में लॉक कर लेता है, जो एक ऐसा परिवर्तन था जिसका मूल मॉडल ने पहले कभी सामना नहीं किया था। परिणाम एक ऐसा मॉडल था जो न केवल इस नए, लॉक किए गए आकार की भविष्यवाणी कर सका, बल्कि दवा के बाइंडिंग साइट (जुड़ने के स्थान) की भी सही पहचान कर सका, और यह सब अपनी मूल क्षमता—प्रोटीन के सामान्य, सक्रिय आकार की भविष्यवाणी करने की क्षमता—को बनाए रखते हुए किया।
शोधकर्ताओं ने पाया कि इस नए, प्रशिक्षित मॉडल ने केवल इन दस विशिष्ट छवियों को रटा नहीं। इसने उस अंतर्निहित तर्क को सीखा कि कैसे दवा प्रोटीन को बदलने के लिए मजबूर करती है, जिससे यह उन विभिन्न रासायनिक श्रेणियों की दवाओं पर सामान्यीकरण (जनरलाइज) करने में सक्षम हुआ जिन्हें इसने पहले कभी नहीं देखा था। इसके अलावा, यह नया ज्ञान एक ही परिवार के अन्य प्रोटीनों, जिन्हें रेक्यू हेलिकेज़ (RecQ helicases) के रूप में जाना जाता है, में स्थानांतरित हो गया, लेकिन केवल तभी जब बाइंडिंग साइट का विशिष्ट अनुक्रम उस तर्क से मेल खाता था जिसे मॉडल ने सीखा था। यह सुझाव देता है कि मॉडल ने केवल आकारों की नकल करने के बजाय परिवर्तन के अंतर्निहित तंत्र को वास्तव में समझ लिया था। यह कार्य इंगित करता है कि इन शक्तिशाली कंप्यूटर मॉडलों को नए संरचनात्मक डेटा के उपलब्ध होने पर अनुकूलित किया जा सकता है, जिससे वे उन सूक्ष्म, लिगैंड-प्रेरित स्विचों (ligand-induced switches) को पकड़ सकते हैं जो जीव विज्ञान के नियमन और दवाओं के हस्तक्षेप के केंद्र में हैं। यह दिखाकर कि सीमा मॉडल के आर्किटेक्चर में नहीं बल्कि प्रशिक्षण डेटा में निहित है, यह अध्ययन इन उपकरणों को वास्तविक दुनिया में प्रोटीनों की गतिशील, बदलती प्रकृति को संभालने के लिए अपडेट करने का एक स्पष्ट मार्ग प्रदान करता है।
अपने क्षेत्र के पेपरों की भीड़ में उलझे हुए हैं?
आपके रिसर्च कीवर्ड से मेल खाने वाले सबसे नए और अलग सोच वाले पेपरों का रोज़ाना Digest पाएँ—तकनीकी सारांश के साथ, आपकी भाषा में।