TDEP: Predicting Target Perturbation Response from Drug-Induced Transcriptomes
TDEP is een diep neuraal netwerk dat embeddings van eiwittaalmodellen en graph attention networks benut om accuraat transcriptoombrede doelwit-perturbatierespons te voorspellen vanuit door medicijnen geïnduceerde profielen, waarbij de nauwkeurigheid van structuurgebaseerde methoden wordt geëvenaard terwijl het gedetailleerde gen-niveau mechanistische inzichten biedt voor doelwitprioritering en hergebruik van medicijnen.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van een preprint die niet peer-reviewed is. Dit is geen medisch advies. Neem geen gezondheidsbeslissingen op basis van deze inhoud. Lees de volledige disclaimer
Het vinden van de juiste sleutel voor een biologisch slot is de centrale uitdaging van de moderne medicijnontwikkeling. Wetenschappers weten al lang dat medicijnen werken door zich te hechten aan specifieke eiwitten in het lichaam, vergelijkbaar met een sleutel die in een slot past. Als de sleutel past, kan hij het slot draaien om een ziekte te stoppen of een genezingsproces te starten. Decennialang hebben onderzoekers geprobeerd deze matches te voorspellen met behulp van twee hoofdstrategieën. Eén benadering kijkt naar de fysieke vorm van de moleculen, waarbij wordt geprobeerd te zien of ze als puzzelstukjes in elkaar passen. De andere benadering kijkt naar de chemische nasleep, waarbij wordt geobserveerd hoe de interne instructies van een cel veranderen wanneer een medicijn wordt geïntroduceerd. Hoewel de vormgebaseerde methoden goed zijn in het raden of er een match zal plaatsvinden, falen ze vaak in het verklaren van wat er daarna gebeurt. De chemische methoden kunnen de nasleep wel laten zien, maar hebben moeite om precies aan te wijzen welk eiwit de verandering heeft veroorzaakt, omdat ze vaak verdwalen in de ruis van de complexe reacties van de cel.
Een team onderzoekers aan de Ewha Womans University in Zuid-Korea heeft een nieuwe manier ontwikkeld om deze kloof te overbruggen. Ze hebben een systeem ontwikkeld genaamd TDEP, wat staat voor Target-perturbed Differential Expression Profile. In plaats van alleen te voorspellen of een medicijn aan een eiwit zal hechten, voorspelt TDEP het specifieke rimpeleffect dat dat eiwit zal veroorzaken in de volledige instructiehandleiding van de cel, bekend als het transcriptoom. Stel je een cel voor als een enorme bibliotheek vol boeken, waarbij elk boek een gen is. Wanneer een medicijn een doelwit-eiwit raakt, schakelt het niet alleen één boek uit; het verandert de leesvolgorde van duizenden anderen. TDEP leert de reactie van de bibliotheek op een medicijn te lezen en werkt vervolgens achteruit om precies te voorspellen welk eiwit de oorspronkelijke oorzaak van die verstoring was. Dit stelt wetenschappers in staat om niet alleen de match te vinden, maar ook het biologische verhaal te begrijpen dat daarop volgt.
De onderzoekers bouwden hun systeem door een computer te leren patronen te herkennen in enorme hoeveelheden biologische data. Ze begonnen met een grote collectie door medicijnen geïnduceerde veranderingen in genactiviteit, verzameld uit een publieke database genaamd de Connectivity Map. Deze database bevat meer dan een miljoen momentopnames van hoe verschillende cellen reageren op diverse chemicaliën. Het team koppelde deze chemische momentopnames aan de genetische sequenties van de eiwitten die de medicijnen bedoeld zijn aan te raken. Ze gebruikten een type kunstmatige intelligentie dat eiwitsequenties begrijpt, vergelijkbaar met hoe een taalmodel zinnen begrijpt, om de doelwit-eiwitten te representeren. Vervolgens trainden ze het systeem om een specifiek eiwit te verbinden met het unieke patroon van genveranderingen dat het produceert. Het systeem zegt niet alleen "ja" of "nee" tegen een interactie; het genereert een gedetailleerde kaart van hoe de genen van de cel zouden toenemen of afnemen als dat specifieke eiwit geblokkeerd zou worden.
Toen het team hun nieuwe systeem testte tegen bestaande methoden, waren de resultaten opmerkelijk. Ze vergeleken TDEP met oudere modellen die vertrouwen op moleculaire vormen en andere die vertrouwen op genetische data uit experimenten waarbij genen kunstmatig werden uitgeschakeld. In tests met medicijnen die het systeem nog nooit eerder had gezien, bereikte TDEP een AUC van 0,87 in het correct identificeren van interacties. Deze prestatie was vergelijkbaar met de beste vormgebaseerde modellen, die momenteel als de gouden standaard worden beschouwd, en aanzienlijk beter dan de oudere genetische methoden, die moeite hadden om een AUC van 0,6 te bereiken. De onderzoekers ontdekten dat het systeem bijzonder goed was in het leren van de gegeven data, waarbij het de veelvoorkomende valkuil van het simpelweg memoriseren van antwoorden vermeed. Het leerde de onderliggende biologische logica te herkennen die een eiwit verbindt met zijn cellulaire consequenties.
Een van de belangrijkste ontdekkingen was hoe het systeem omgaat met verschillende soorten onbekenden. De onderzoekers testten het model in twee scenario's: één waarbij de medicijnen nieuw waren maar de eiwitten bekend, en een andere waarbij de eiwitten volledig nieuw waren. Ze ontdekten dat het systeem twee verschillende instrumenten gebruikt om deze problemen op te lossen. Wanneer het eiwit bekend is, vertrouwt het systeem op de gedetailleerde kaart van genveranderingen die het heeft geleerd om de uitkomst te voorspellen. Wanneer het eiwit nieuw is, leunt het systeem op zijn diepe begrip van de genetische sequentie van het eiwit om een gefundeerde schatting te maken. Deze tweeledige aanpak zorgt ervoor dat het systeem robuust is, en goed werkt of het nu een nieuw medicijn of een nieuw doelwit tegenkomt. Bovendien toonde het systeem aan dat het zijn kennis kan overdragen naar verschillende typen cellen. Een model getraind op één type kankercel kon nog steeds nauwkeurige voorspellingen doen wanneer het werd toegepast op een ander type kankercel, wat suggereert dat de fundamentele regels van hoe deze eiwitten genen beïnvloeden, gedeeld worden over verschillende biologische contexten.
Het team keek ook nauwgezet naar of het systeem daadwerkelijk de biologie leerde of slechts shortcuts vond. Ze onderzochten de specifieke genen die het systeem voorspelde te veranderen wanneer een doelwit werd geblokkeerd, en vergeleken dit met real-world data uit andere experimenten. Ze vonden een sterke overeenkomst. Bijvoorbeeld, wanneer het systeem het effect voorspelde van het blokkeren van een specifiek hart-gerelateerd eiwit, kwamen de genen die het systeem als meest waarschijnlijk veranderend aanwees overeen met de genen die daadwerkelijk veranderden in onafhankelijke experimenten waarbij dat eiwit werd verwijderd. Dit suggereert dat het systeem echte biologische signalen opvangt in plaats van enkel statistische ruis. De onderzoekers merkten op dat hoewel de voorspellingen niet perfect zijn en de effectgroottes soms klein zijn, het vermogen om een verklaring op genniveau te genereren voor de werking van een medicijn een belangrijke stap voorwaarts is. Het biedt een manier om hypothesen te genereren over hoe een medicijn werkt, die vervolgens in het lab getest kunnen worden.
Ondanks deze successen zijn de onderzoekers voorzichtig in het aangeven van de grenzen van hun werk. Het systeem vertrouwt momenteel op data van een specifieke set kankercellijnen en medicijnen die al in de publieke database zijn geprofileerd. Het kan nog niet de effecten voorspellen van volledig nieuwe chemische structuren die nog nooit in een laboratorium zijn getest. Daarnaast voorspelt het systeem of een medicijn met een doelwit zal interageren, maar het meet niet hoe sterk ze binden. De onderzoekers erkennen ook dat de biologische data die zij gebruiken afkomstig zijn van een specifieke technologie, en dat de resultaten kunnen variëren als ze worden toegepast op data van andere meetplatforms. Echter, de kernprestatie blijft: zij hebben aangetoond dat het mogelijk is om de gedetailleerde transcriptionele consequenties van het targeten van een specifiek eiwit met hoge nauwkeurigheid te voorspellen.
Dit werk biedt een nieuw perspectief op hoe we medicijnontwikkeling benaderen. Door verder te gaan dan eenvoudige ja-of-nee voorspellingen, biedt TDEP een venster naar het werkingsmechanisme. Het stelt wetenschappers in staat om de potentiële bijwerkingen of therapeutische voordelen van een medicijn te zien door te kijken naar het specifieke patroon van genveranderingen dat het voorspeld wordt te veroorzaken. De onderzoekers suggereren dat deze aanpak kan helpen bij het prioriteren van welke medicijn-targets de moeite waard zijn om na te streven, nieuwe ideeën kan genereren over hoe bestaande medicijnen werken, en zelfs kan helpen bij het vinden van nieuwe toepassingen voor oude medicijnen. Naarmate de databases met biologische data blijven groeien en de kunstmatige intelligentie-modellen geavanceerder worden, zou deze methode om eiwitdoelwitten te koppelen aan hun volledige cellulaire consequenties een standaardinstrument kunnen worden in de zoektocht naar het begrijpen en behandelen van ziekten. De studie dient als een bewijs van concept dat het combineren van genetische sequenties met cellulaire responsdata inzichten kan opleveren die geen van beide benaderingen alleen had kunnen bereiken.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.