Integration of proteomic data from cell lines and tumors
Gli autori introducono ProtInt, un framework di deep learning che integra con successo i dati proteomici delle linee cellulari tumorali e dei tumori dei pazienti superando le sfide legate ai valori mancanti, superando così i metodi esistenti e rivelando i cambiamenti biologici chiave necessari per allineare meglio i modelli preclinici alla realtà clinica.
Articolo originale sotto licenza CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Questa è una spiegazione generata dall'IA di un preprint non sottoposto a revisione paritaria. Non è un consiglio medico. Non prendere decisioni sulla salute basandoti su questo contenuto. Leggi il disclaimer completo
La ricerca sul cancro si basa pesantemente su uno strumento semplice e potente: la linea cellulare tumorale. Si tratta di gruppi di cellule cancerose coltivate in una piastra da laboratorio, mantenute in vita per decenni e utilizzate dagli scienziati per studiare il comportamento dei tumori e testare nuovi farmaci. Poiché sono facili da coltivare e da condividere, esse costituiscono l'ossatura degli studi preclinici. Tuttavia, un problema ostinato affligge da tempo il campo: i risultati ottenuti da queste cellule coltivate in vitro spesso non si traducono in trattamenti efficaci per i pazienti reali. Le cellule in una piastra di Petri mancano del complesso ambiente di un corpo umano e, nel tempo, possono allontanarsi geneticamente e chimicamente dai tumori da cui sono state originariamente prelevate. Per colmare questo divario, i ricercatori hanno bisogno di un modo per confrontare direttamente la composizione molecolare di queste cellule coltivate in laboratorio con la composità molecolare dei veri tumori dei pazienti. Sebbene gli scienziati abbiano confrontato con successo le istruzioni genetiche, ovvero l'RNA, di questi due gruppi, un confronto simile per le proteine — le molecole effettive che i farmaci solitamente prendono di mira — è rimasto fuori portata. Ciò è dovuto principalmente al fatto che i dati proteici sono notoriamente disordinati, con spesso grandi parti di informazioni mancanti a causa dei limiti delle macchine utilizzate per misurarli.
Un team di ricercatori ha sviluppato un nuovo metodo chiamato ProtInt per risolvere questo specifico enigma. Hanno applicato questo approccio a una vasta collezione di dati, combinando le misurazioni proteiche di 771 diverse linee cellulari tumorali con i dati di 550 tumori di pazienti mai trattati in 13 diversi tipi di tessuto. L'obiettivo era creare una mappa unificata in cui i due distinti gruppi potessero essere visti fianco a fianco, non come isole separate, ma come parti di un unico paesaggio. I ricercatori hanno scoperto che i metodi standard utilizzati per pulire i dati o allineare le informazioni genetiche semplicemente non potevano gestire le lacune uniche e i valori mancanti tipici dei dataset proteici. Quando hanno cercato di forzare questi vecchi metodi per farli funzionare, le linee cellulari e i tumori rimanevano ostinatamente separati. ProtInt, tuttavia, utilizza un sofisticato sistema di apprendimento che comprende come vengono misurate le proteine e perché i dati manchino. Impara a colmare le lacune in modo realistico, regolando simultaneamente i dati in modo che le linee cellulari e i tumori possano essere confrontati direttamente.
I risultati hanno dimostrato che ProtInt ha unificato con successo i due dataset. Nella nuova visione unificata, la separazione artificiale tra le cellule coltivate in laboratorio e i tumori dei pazienti è scomparsa. Invece di due cluster distinti, i campioni hanno iniziato a raggrupparsi in base al tipo di tessuto di provenienza, come polmone, seno o sangue. Questo allineamento non è stato perfetto per ogni singolo tipo di tessuto; ad esempio, le linee cellulari del sistema nervoso centrale e del muscolo liscio hanno ancora faticato a corrispondere ai loro corrispettivi tumorali, probabilmente perché queste cellule specifiche cambiano significativamente quando coltivate in una piastra. Tuttavia, per molti altri tessuti, il metodo ha funzionato sorprendentemente bene. Quando i ricercatori hanno esaminato da vicino ciò che cambiava durante questo allineamento, hanno visto emergere una chiara storia biologica. Man mano che le linee cellulari venivano regolate per assomigliare maggiormente ai tumori reali, i loro profili proteici cambiavano in modi prevedibili. Mostravano un aumento delle proteine legate al sistema immunitario, alla comunicazione tra le cellule e all'interazione con la struttura del tessuto circostante. Allo stesso tempo, le proteine coinvolte nelle funzioni cellulari di base, come la copia delle istruzioni genetiche e la generazione di energia, diminuivano. Questo cambiamento rispecchia la realtà secondo cui i tumori reali esistono all'interno di un complesso ambiente corporeo, mentre le cellule in laboratorio sono spesso isolate e focalizzate puramente sulla crescita rapida.
Lo studio ha anche testato se diverse strategie matematiche potessero ottenere lo stesso risultato. I ricercatori hanno confrontato il loro metodo con altri che si basano su diverse tecniche di apprendimento, come quelle che cercano di forzare i dati a tornare al loro stato originale. Hanno scoperto che questi approcci alternativi non hanno performato altrettanto bene; o fallivano nel mescolare efficacemente i dati o introducevano troppi errori. ProtInt si è dimostrato superiore perché ha tenuto conto specificamente del modo in cui i dati mancanti si comportano negli esperimenti proteici, trattando le lacune non come rumore casuale, ma come un modello correlato all'abbondanza di una proteina. Ciò ha permesso al sistema di ricostruire i valori mancanti con alta precisione, garantendo che il confronto finale si basasse su un quadro completo. I ricercatori hanno osservato che, sebbene il metodo funzioni bene per il tipo specifico di dati proteici utilizzati, non è ancora pronto per altre comuni tecniche di laboratorio che etichettano le proteine in modo diverso.
In definitiva, questo lavoro fornisce un nuovo quadro per dare senso a dati biologici complessi. Integrando con successo i proteomi delle linee cellulari e dei tumori, ProtInt offre un modo per identificare quali linee cellulari di laboratorio siano i migliori corrispettivi per specifici tumori dei pazienti. Ciò potrebbe aiutare gli scienziati a scegliere i modelli più rilevanti per i loro esperimenti, riducendo potenzialmente il numero di fallimenti nelle sperimentazioni cliniche. Il metodo non sostiene di aver risolto l'intero problema del trattamento del cancro, né garantisce che ogni farmaco testato su queste cellule allineate funzionerà nei pazienti. Inveve, offre una lente più chiara e accurata attraverso cui osservare le differenze tra il laboratorio e la clinica. I ricercatori hanno reso disponibile il loro codice alla comunità scientifica, invitando altri a utilizzare questo strumento per esplorare i vasti mondi, precedentemente disconnessi, della biologia delle linee cellulari e dei tumori.
Sommerso dagli articoli nel tuo campo?
Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.