Integration of proteomic data from cell lines and tumors
De auteurs introduceren ProtInt, een deep learning-framework dat er succesvol in slaagt proteomische gegevens van kankercellijnen en patiënttumoren te integreren door de uitdagingen rondom ontbrekende waarden te overwinnen, waardoor het bestaande methoden overtreft en cruciale biologische verschuivingen onthult die nodig zijn om preklinische modellen beter af te stemmen op de klinische realiteit.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van een preprint die niet peer-reviewed is. Dit is geen medisch advies. Neem geen gezondheidsbeslissingen op basis van deze inhoud. Lees de volledige disclaimer
Kankeronderzoek leunt zwaar op een simpel, krachtig hulpmiddel: de kankercellijn. Dit zijn groepen kankercellen die in een laboratoriumschaaltje worden gekweekt, decennialang in leven worden gehouden en door wetenschappers worden gebruikt om te bestuderen hoe tumoren zich gedragen en om nieuwe medicijnen te testen. Omdat ze gemakkelijk te kweken en te delen zijn, vormen ze de ruggengraat van preklinische studies. Echter, een hardnekkig probleem plaagt het veld al lang: bevindingen uit deze in een schaaltje gekweekte cellen vertalen zich vaak niet naar succesvolle behandelingen voor echte patiënten. De cellen in een petrischaal missen de complexe omgeving van een menselijk lichaam, en in de loop van de tijd kunnen ze genetisch en chemisch afwijken van de tumoren waar ze oorspronkelijk van afkomstig waren. Om deze kloof te overbruggen, hebben onderzoekers een manier nodig om de moleculaire samenstelling van deze in het lab gekweekte cellen direct te vergelijken met de moleculaire samenstelling van echte patiëntentumoren. Hoewel wetenschappers er succesvol in zijn geslaagd om de genetische instructies, of RNA, van deze twee groepen te vergelijken, is een vergelijkbare vergelijking voor eiwitten — de werkelijke werkende moleculen waar medicijnen meestal op gericht zijn — buiten bereik gebleven. Dit komt grotendeels doordat eiwitdata berucht rommelig is, waarbij vaak grote stukken informatie ontbreken door de beperkingen van de machines die worden gebruikt om ze te meten.
Een team van onderzoekers heeft nu een nieuwe methode ontwikkeld genaamd ProtInt om dit specifieke puzzelstuk op te lossen. Ze pasten deze benadering toe op een enorme collectie data, waarbij ze eiwitmetingen van 771 verschillende kankercellijnen combineerden met data van 550 behandeling-naïeve patiëntentumoren uit 13 verschillende weefseltypen. Het doel was om een verenigde kaart te creëren waar de twee verschillende groepen naast elkaar te zien zijn, niet als aparte eilanden, maar als onderdeel van een enkel landschap. De onderzoekers ontdekten dat standaardmethoden die worden gebruikt om data op te schonen of genetische informatie uit te lijnen, simpelweg niet in staat waren om de unieke hiaten en ontbrekende waarden in eiwitdatasets aan te pakken. Wanneer zij probeerden deze oudere methoden te dwingen te werken, bleven de cellijnen en tumoren hardnekkig gescheiden. ProtInt gebruikt echter een geavanceerd leersysteem dat begrijpt hoe eiwitten worden gemeten en waarom data ontbreekt. Het leert de gaten op een realistische manier in te vullen terwijl het tegelijkertijd de data aanpast zodat de kankercellijnen en tumoren direct vergeleken kunnen worden.
De resultaten toonden aan dat ProtInt de twee datasets succesvol heeft samengevoegd. In het nieuwe, verenigde beeld verdween de kunstmatige scheiding tussen de in het lab gekweekte cellen en de patiëntentumoren. In plaats van twee afzonderlijke clusters, begonnen de monsters samen te groeperen op basis van het type weefsel waar ze vandaan kwamen, zoals long, borst of bloed. Deze uitlijning was niet perfect voor elk weefseltype; bijvoorbeeld hadden cellijnen uit het centrale zenuwstelsel en glad spierweefsel nog steeds moeite om met hun tumormotparten te matchen, waarschijnlijk omdat deze specifieke cellen aanzienlijk veranderen wanneer ze in een schaaltje worden gekweekt. Echter, voor veel andere weefsels werkte de methode opmerkelijk goed. Wanneer de onderzoekers nauwkeurig keken naar wat er veranderde tijdens deze uitlijning, zagen ze een duidelijk biologisch verhaal ontstaan. Terwijl de cellijnen werden aangepast om meer op echte tumoren te lijken, verschoven hun eiwitprofielen op voorspelbare wijze. Er was een toename van eiwitten gerelateerd aan het immuunsysteem, communicatie tussen cellen en interactie met de omliggende weefselstructuur. Tegelijkertijd namen eiwitten betrokken bij basale cellulaire processen, zoals het kopiëren van genetische instructies en het genereren van energie, af. Deze verschuiving weerspiegelt de realiteit dat echte tumoren bestaan binnen een complexe lichaamomgeving, terwijl labcellen vaak geïsoleerd zijn en puur gefocust zijn op snelle groei.
De studie testte ook of verschillende wiskundige strategieën hetzelfde resultaat konden bereiken. De onderzoekers vergeleken hun methode met andere die vertrouwen op verschillende leerntechnieken, zoals die die proberen data terug te laten cyclen naar de oorspronkelijke staat. Ze ontdekten dat deze alternatieve benaderingen niet even goed presteerden; ze slaagden er ofwel niet in de data effectief te mengen, of introduceerden te veel fouten. ProtInt bleek superieur omdat het specif
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.