← Nieuwste papers
💻 bioinformatics

Interrogating contrastive learning embeddings for structure-based virtual screening: a case study on DrugCLIP

Dit artikel evalueert systematisch de contrastieve leer-embeddings van DrugCLIP voor structuurgebaseerde virtuele screening, waarbij wordt onthuld dat hoewel de pocket-embeddings snelle en robuuste structurele gelijkeniszoekingen bieden en de ligand-embeddings pocket-bewuste chemische patronen met een sterke generalisatie naar onbekende targets vastleggen, de prestaties aanzienlijk worden beperkt door conformationele variaties en onnauwkeurigheden in voorspelde eiwitpockets.

Oorspronkelijke auteurs: Sanchez Utges, J., Jones, D. T., Orengo, C.

Gepubliceerd 2026-09-18
📖 5 min leestijd🧠 Diepgaand

Oorspronkelijke auteurs: Sanchez Utges, J., Jones, D. T., Orengo, C.

Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). ⚕️ Dit is een AI-gegenereerde uitleg van een preprint die niet peer-reviewed is. Dit is geen medisch advies. Neem geen gezondheidsbeslissingen op basis van deze inhoud. Lees de volledige disclaimer

Het vinden van een nieuw medicijn is een traag en duur gokproces. Het kan vijftien jaar duren en meer dan een miljard dollar kosten om een enkel geneesmiddel op de markt te brengen, voornamelijk omdat de meeste potentiële kandidaten onderweg falen. Om deze verspilling te verminderen, gebruiken wetenschappers computerprogramma's om door miljoenen chemische verbindingen te zeven, op zoek naar de weinigen die mogelijk aan een specifiek ziekteveroorzakend eiwit kunnen blijven plakken. Dit proces, genaamd virtuele screening, werkt als een filter dat een enorme bibliotheek aan mogelijkheden terugbrengt naar een beheersbare lijst voor experimenten in de echte wereld. Decennialang vertrouwde dit op het afstemmen van de fysieke vorm van een medicijn op de vorm van de bindingsplaats van een eiwit, een taak die rekenintensief is en vaak te traag voor het enorme aantal eiwitten en chemicaliën die nu beschikbaar zijn.

Onlangs is er een nieuwe aanpak ontstaan die deze zoektocht behandelt als een taalvertalingsprobleem. In plaats van de fysica van elke individuele interactie te berekenen, gebruiken deze methoden kunstmatige intelligentie om zowel de bindingspocket van het eiwit als het medicijnmolecuul te vertalen naar een gedeelde, abstracte taal van getallen. In deze gedeelde ruimte zal een medicijn dat goed bij een eiwit past, een getallenpatroon hebben dat zeer vergelijkbaar is met het eigen patroon van het eiwit, terwijl een slechte match er heel anders uitziet. Dit stelt computers in staat om goede matches te vinden door simpelweg deze getallenpatronen te vergelijken, een proces dat ongelooflijk snel is. Eén dergelijke tool, genaamd DrugCLIP, heeft veelbelovende resultaten laten zien, maar tot nu toe begrepen wetenschappers niet wat deze abstracte getallenpatronen precies representeerden. Ze wisten dat de tool werkte, maar ze wisten niet of het werkelijk de chemie begreep of alleen de antwoorden uit het hoofd leerde.

Een team van onderzoekers aan University College London besloot de 'black box' van DrugCLIP te openen om te zien wat er precies binnenin gebeurde. Ze behandelden de tool niet als een toverstaf, maar als een systeem dat gemeten en begrepen kon worden. Hun onderzoek onthulde dat de tool iets veel nuttigers had geleerd dan alleen het koppelen van medicijnen aan eiwitten. De onderzoekers ontdekten dat de interne representatie van de tool van een bindingspocket van een eiwit zo accuraat was, dat het vergelijkbare pockets in verschillende eiwitten beter kon identificeren dan welke bestaande methode dan ook, en dat het dit meer dan honderd keer sneller deed. Dit was een verrassing, omdat de tool nooit expliciet was geleerd om vergelijkbare pockets te vinden; de tool was alleen geleerd om medicijnen te vinden die binden. Toch had de tool in het proces van het leren vinden van medicijnen, onbedoeld geleerd om de vorm en structuur van de pockets zelf met opmerkelijke precisie te herkennen.

Het team onderzocht ook hoe de tool omging met de fysieke realiteit van moleculen. Eiwitten en medicijnen zijn geen rigide standbeelden; ze wiebelen en bewegen. De onderzoekers testten of de tool in de war zou raken als een medicijnmolecuul in een iets andere vorm werd getoond of als het eiwit in een iets andere positie stond. Ze ontdekten dat de tool opmerkelijk robuust was. Zelfs wanneer hetzelfde medicijn in tientallen verschillende wiebelende vormen werd getoond, herkende de tool ze als hetzelfde molecuul. Op dezelfde manier bleef de interne kaart van de tool consistent wanneer de eiwitpocket in verschillende toestanden werd getoond — sommige gebonden aan een medicijn, sommige leeg, en sommige voorspeld door andere AI-modellen. De studie trok echter ook een duidelijke grens waar de prestaties van de tool begonnen te verslechteren. Wanneer de onderzoekers voorspelde eiwitstructuren gebruikten die de verkeerde aminozuren in de bindingsplaats hadden, of wanneer de zijketens van het eiwit de verkeerde kant op wezen, nam het vermogen van de tool om het juiste medicijn te vinden aanzienlijk af. Dit gaf aan dat hoewel de tool krachtig is, deze nog steeds afhankelijk is van een nauwkeurig beeld van de fysieke structuur van het eiwit.

Misschien wel de belangrijkste bevinding was een test om te kijken of de tool vertrouwde op memorisatie. De onderzoekers creëerden een strikte test waarbij ze de tool vroegen om medicijnen te vinden voor eiwitten en chemicaliën die het nog nooit eerder had gezien, om er zeker van te zijn dat het niet simpelweg bekende paren uit de trainingsdata kon oproepen. De resultaten waren bemoedigend. Voor nieuwe eiwitten met volledig nieuwe chemie slaagde de tool er nog steeds in om het juiste medicijn binnen de top één procent van alle mogelijke kandidaten te rangschikken in ongeveer 55 tot 75 procent van de gevallen. Dit bewees dat de tool daadwerkelijk de regels van hoe eiwitten en medicijnen interageren leerde, in plaats van alleen maar een lijst met bekende paren uit het hoofd te leren. Het toonde aan dat de tool zijn kennis kon generaliseren naar geheel nieuwe situaties, een cruciale vereiste voor echte medicijnontwikkeling.

De studie concludeerde dat hoewel tools zoals DrugCLIP een enorme sprong voorwaarts betekenen in snelheid en capaciteit, ze nog niet perfect zijn. Hun succes hangt af van de nauwkeurigheid van de verstrekte eiwitstructuur. Als het startmodel van het eiwit er net naast zit, of als de voorspelde bindingsplaats de verkeerde atomen bevat, lijdt de prestatie van de tool daaronder. De onderzoekers suggereren dat de volgende stap in het verbeteren van deze systemen niet alleen betere AI is, maar betere methoden voor het voorspellen van de precieze vorm van eiwitpockets. Door deze snelle, slimme screeningsinstrumenten te combineren met nauwkeurigere structurele voorspellingen, kunnen wetenschappers dichter bij een toekomst komen waarin het vinden van nieuwe medicijnen sneller, goedkoper en betrouwbaarder is. Het werk demystificeert een complexe technologie en laat zien dat het een krachtige nieuwe lens is om de moleculaire wereld te zien, mits de lens zelf stabiel wordt gehouden.

Verdrinkt u in papers in uw vakgebied?

Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.

Probeer Digest →