Automated Classification of AML and Multiple Myeloma from Blood Smear Whole Slide Images using Deep Neural Networks
Questo articolo presenta una pipeline di deep learning completamente non supervisionata che raggiunge un'elevata accuratezza diagnostica nella classificazione della leucemia mieloide acuta e del mieloma multiplo da immagini di vetrini interi di striscioli ematici, combinando il rilevamento dei bordi di Sobel, il clustering tramite modello di miscela gaussiana e il transfer learning basato su VGG16 senza richiedere annotazioni manuali.
Articolo originale sotto licenza CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Questa è una spiegazione generata dall'IA dell'articolo qui sotto. Non è stata scritta né approvata dagli autori. Per precisione tecnica, consulta l'articolo originale. Leggi il disclaimer completo
Nel silenzioso e cruciale mondo della diagnosi medica, i patologi si affidano spesso allo strumento più fondamentale disponibile: il microscopio. Quando un paziente presenta sintomi di leucemia ematica, un medico preleva una minuscola goccia di sangue, la stende su un vetrino da laboratorio e la colora con coloranti colorati per rivelare l'architettura nascosta delle cellule. Due forme particolarmente aggressive di cancro del sangue, la leucemia mieloide acuta e il mieloma multiplo, lasciano impronte digitali distinte in questi paesaggi cellulari. Per decenni, occhi umani esperti sono stati il gold standard per leggere questi vetrini, identificando sottili differenze nella forma e nella disposizione delle cellule che segnalano la malattia. Tuttavia, la medicina moderna ha iniziato a digitalizzare questo processo, creando enormi immagini digitali ad alta risoluzione di interi vetrini. Questi file digitali sono così grandi che si misurano in gigapixel, contenendo milioni di minuscoli dettagli che sovraccaricano i programmi informatici tradizionali. La sfida per gli scienziati è stata quella di insegnare ai computer a vedere ciò che un patologo umano vede all'interno di questi enormi file, senza perdersi nell'enorme volume di dati o richiedere a un essere umano di indicare manualmente ogni singola cellula.
Un team di ricercatori della Lewis University ha sviluppato un nuovo modo per risolvere questo problema, creando un sistema in grado di distinguere automaticamente tra leucemia mieloide acuta e mieloma multiplo da questi enormi vetrini digitali di sangue senza alcun aiuto umano. Invece di cercare di analizzare l'intera immagine gigante in una volta sola, il che è troppo per un computer, i ricercatori hanno scomposto il problema in pezzi più piccoli e gestibili. Hanno trattato il vetrino digitale come un enorme mosaico e lo hanno suddiviso in migliaia di minuscole piastrelle quadrate. Il primo passo è stato quello di insegnare al computer a ignorare gli spazi vuoti. Proprio come un essere umano ignorerebbe i margini bianchi di una pagina per concentrarsi sul testo, i ricercatori hanno utilizzato un filtro matematico per evidenziare i bordi degli oggetti all'interno dell'immagine. Questo filtro, noto come rilevatore di bordi Sobel, agisce come un evidenziatore, tracciando i contorni di cellule e tessuti mentre sfuma lo sfondo vuoto e i bordi scuri del vetrino.
Una volta che il computer aveva identificato quali piastrelle contenevano materiale biologico effettivo, ha utilizzato un metodo di clustering per separare le piastrelle utili da quelle inutili. Questo processo è simile a smistare un sacchetto misto di biglie per colore senza mai essere stati istruiti sui colori; il computer ha osservato i modelli dei bordi in ogni piastrella e le ha raggruppate in base alla somiglianza. Questo approccio non supervisionato ha permesso al sistema di scartare automaticamente le piastrelle che erano solo sfondo vuoto o artefatti dell'immagine, lasciando dietro di sé una collezione pulita di piastrelle piene di strutture cellulari. Dal set originale di trentaquattro vetrini digitali, questo processo di filtraggio ha prodotto quasi 385.000 piastrelle informative contenenti cellule, scartando oltre 154.000 piastrelle che non offrivano alcun valore diagnostico.
Con una collezione curata di queste piastrelle cellulari, i ricercatori si sono poi rivolti a uno strumento potente chiamato transfer learning per insegnare al computer come distinguere i due tipi di cancro. Hanno utilizzato un modello di deep learning preesistente, originariamente addestrato su milioni di fotografie quotidiane di gatti, cani e auto, e lo hanno riadattato per osservare le cellule del sangue. Poiché il computer aveva già imparato a riconoscere forme, texture e pattern complessi dal suo addestramento su immagini generiche, poteva adattarsi rapidamente al compito specifico di identificare le cellule tumorali del sangue senza la necessità di un enorme database di immagini mediche etichettate. I ricercatori hanno inserito le piastrelle selezionate in questo sistema, che ha estratto caratteristiche profonde e nascoste dalle immagini e le ha passate a una rete neurale progettata su misura per prendere la decisione finale. Questa rete ha imparato a riconoscere le sottili differenze morfologiche tra i due tipi di cancro, diventando efficacementamente un classificatore esperto.
I risultati di questo processo automatizzato sono stati sorprendentemente precisi. Quando testato su un set di piastrelle che non aveva mai visto prima, il sistema ha identificato correttamente il tipo di cancro in quasi il novantasette percento dei casi. È stato altamente efficace nel individuare la malattia quando era presente ed è stato altrettanto bravo a confermare quando era assente, minimizzando il rischio di falsi allarmi. Per garantire che il computer non stesse semplicemente tirando a indovinare, i ricercatori hanno utilizzato una tecnica di visualizzazione che evidenziava esattamente quali parti dell'immagine il modello stava osservando quando prendeva la sua decisione. Queste mappe visive hanno mostrato che il sistema si stava concentrando sulle effettive strutture cellulari, le stesse caratteristiche che un patologo umano esaminerebbe, piuttosto che su rumore casuale o parti irrilevanti del vetrino.
Questo lavoro dimostra che è possibile costruire uno strumento diagnostico altamente accurato per il cancro del sangue utilizzando un processo completamente automatizzato che non richiede la etichettatura manuale delle immagini da parte dei medici. Combinando il rilevamento dei bordi per trovare le cellule, il clustering per pulire i dati e il transfer learning per estrarre le caratteristiche, i ricercatori hanno creato una pipeline che supera molti metodi esistenti che si basano su tecniche più vecchie e meno sofisticate. Lo studio suggerisce che, anche con un numero relativamente piccolo di campioni di pazienti, è possibile raggiungere un'elevata accuratezza diagnostica se i dati vengono elaborati correttamente. Tuttavia, gli autori tengono prudentemente presente che questo sistema è progettato per assistere i professionisti medici, non per sostituirli. L'attuale modello è stato addestrato e testato su piastrelle tratte dallo stesso set di vetrini, il che significa che non è ancora stato dimostrato che funzioni su pazienti completamente nuovi provenienti da ospedali diversi o con diversi metodi di colorazione. Sebbene la tecnologia mostri grande promessa per il futuro della patologia digitale, i ricercatori sottolineano che ulteriori test su gruppi indipendenti di pazienti sono necessari prima che uno strumento del genere possa essere utilizzato in un contesto clinico reale per guidare le decisioni terapeutiche.
Sommerso dagli articoli nel tuo campo?
Ricevi digest giornalieri degli articoli più recenti corrispondenti alle tue parole chiave di ricerca — con riassunti tecnici, nella tua lingua.