Targeted finetuning enables co-folding models to learn ligand-induced protein conformational states
Dit artikel toont aan dat gerichte fijnafstemming van fundamentele modellen zoals Boltz-1 de biases in trainingsdata kan overwinnen om nauwkeurig nieuwe ligand-geïnduceerde eiwitconformatiestaten en allosterische bindingsplaatsen te voorspellen, waardoor effectievere toepassingen voor medicijnontdekking mogelijk worden.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van een preprint die niet peer-reviewed is. Dit is geen medisch advies. Neem geen gezondheidsbeslissingen op basis van deze inhoud. Lees de volledige disclaimer
Decennialang hebben wetenschappers gezocht naar een manier om de driedimensionale vorm van een eiwit te voorspellen door enkel naar de genetische code te kijken. Dit is geen kleine prestatie, aangezien eiwitten geen starre staven zijn, maar flexibele ketens die draaien en buigen in complexe vormen om hun taken uit te voeren. In de afgelopen jaren zijn krachtige computermodellen opgekomen die deze vormen met opmerkelijke nauwkeurigheid kunnen voorspellen, zelfs wanneer een eiwit gebonden is aan een klein molecuul, zoals een medicijn. Deze modellen, vaak co-folding tools genoemd, zijn getraind op enorme bibliotheken van bekende structuren, waarbij ze de algemene regels leren over hoe eiwitten en moleculen in elkaar passen. Er blijft echter een aanzienlijke hindernis bestaan: deze modellen hebben vaak moeite wanneer ze geconfronteerd worden met een eiwit dat van vorm verandert als reactie op een nieuw medicijn, of wanneer het medicijn bindt aan een deel van het eiwit dat nog nooit eerder is gezien. Als een model deze veranderingen niet kan zien, kan het onderzoekers niet helpen bij het ontwerpen van medicijnen die daarop vertrouwen, waardoor er een kloof ontstaat tussen wat de computer voorspelt en wat er daadwerkelijk gebeurt in een levende cel.
Een team onderzoekers heeft onlangs deze kloof aangepakt door aan te tonen dat het falen van deze modellen niet te wijten is aan een fout in hun ontwerp, maar aan een bias in de data waarop ze zijn getraind. Zij demonstreerden dat door het model zorgvuldig een paar specifieke nieuwe voorbeelden te leren, het kon leren om complexe, onbekende gedragingen te voorspellen. Met behulp van tien nieuwe röntgenbeelden van een eiwit genaamd Werner helicase, dat betrokken is bij DNA-herstel en werd bestudeerd tijdens een medicijnontwikkelingsprogramma, namen de onderzoekers een krachtig bestaand model en gaven het een gerichte les. Ze lieten het zien hoe dit eiwit zichzelf vergrendelt in een inactieve staat wanneer een specifiek medicijn bindt aan een ongewone plek, een verandering die het oorspronkelijke model nog nooit was tegengekomen. Het resultaat was een model dat niet alleen deze nieuwe, vergrendelde vorm kon voorspellen, maar ook correct de bindingsplaats van het medicijn kon identificeren, terwijl het zijn oorspronkelijke vermogen behield om de normale, actieve vorm van het eiwit te voorspellen.
De onderzoekers ontdekten dat dit nieuwe, getrainde model meer deed dan alleen deze tien specifieke afbeeldingen memoriseren. Het leerde de onderliggende logica van hoe het medicijn het eiwit dwingt om te veranderen, waardoor het kon generaliseren naar verschillende chemische series van medicijnen die het nog nooit eerder had gezien. Bovendien werd dit nieuwe begrip overgedragen op andere eiwitten in dezelfde familie, bekend als RecQ helicases, maar alleen wanneer de specifieke sequentie van de bindingsplaats overeenkwam met de logica die het model had geleerd. Dit suggereert dat het model werkelijk het mechanisme van de verandering had begrepen, in plaats van alleen de vormen te hebben gekopieerd. Het werk geeft aan dat deze krachtige computermodellen kunnen worden aangepast naarmate er nieuwe structurele data beschikbaar komt, waardoor ze de subtiele, door liganden geïnduceerde schakelingen kunnen vangen die centraal staan in hoe biologie wordt gereguleerd en hoe medicijnen kunnen ingrijpen. Door aan te tonen dat de beperking in de trainingsdata ligt en niet in de architectuur, biedt de studie een duidelijk pad vooruit om deze hulpmiddelen bij te werken om de dynamische, verschuivende aard van eiwitten in de echte wereld te kunnen hanteren.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.