Deep Transfer Learning for Automated Cervical Cell-Type Classification in Pap-Smear Images: A Comparative and Explainable Study
Deze studie toont aan dat een op ResNet50 gebaseerd deep transfer learning-model, versterkt met uitlegbare AI-technieken zoals Grad-CAM, een hoge nauwkeurigheid (91,50%) bereikt bij het classificeren van vijf verschillende typen cervicale cellen uit Pap-smear-afbeeldingen, hoewel het specifieke uitdagingen ervaart bij het onderscheiden tussen de Koilocytotische en Metaplastische klassen.
Oorspronkelijk artikel gelicentieerd onder CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Dit is een AI-gegenereerde uitleg van het onderstaande artikel. Het is niet geschreven of goedgekeurd door de auteurs. Raadpleeg het oorspronkelijke artikel voor technische nauwkeurigheid. Lees de volledige disclaimer
Elk jaar ondergaan miljoenen vrouwen een eenvoudige, routinematige screeningsprocedure om vroege tekenen van baarmoederhalskanker op te sporen. In deze procedure, bekend als een uitstrijkje (Pap-test), neemt een arts een monster van cellen van de baarmoederhals af en stuurt dit naar een laboratorium. Daar bekijkt een patholoog de cellen onder een microscoop, op zoek naar subtiele veranderingen in hun vorm, grootte en textuur die op ziekte kunnen wijzen. Hoewel deze methode talloze levens heeft gered, rust zij volledig op menselijke ogen en oordeelsvorming. Wanneer een laboratorium duizenden monsters ontvangt, kan de enorme hoeveelheid leiden tot vermoeidheid, en de minuscule verschillen tussen een gezonde cel en een licht abnormale cel kunnen gemakkelijk over het hoofd worden gezien. Om te helpen, hebben wetenschappers jarenlang geprobeerd computers te leren deze afbeeldingen te lezen, in de hoop een betrouwbare assistent te creëren die de waarschuwingssignalen met dezelfde zorgvuldigheid kan opsporen als een menselijke expert.
De uitdaging ligt in de complexiteit van de cellen zelf. Baarmodercellen zijn niet uniform; ze komen in verschillende typen voor, en sommige van deze typen lijken verdraaid veel op elkaar. Het onderscheiden van deze typen vereist het opmerken van minuscule details in de kern en het omliggende cytoplasma. Een computerprogramma dat simpelweg pixels telt of naar basisvormen kijkt, faalt vaak omdat het deze genuanceerde biologische patronen niet kan begrijpen. Hier komt een techniek genaamd transfer learning in beeld. In plaats van een computer vanaf nul te leren kijken, nemen onderzoekers een model dat al heeft geleerd om duizenden alledaagse objecten te herkennen — zoals katten, auto's en bomen — en passen dit aan om naar medische afbeeldingen te kijken. Het idee is dat de computer al heeft geleerd hoe hij randen, texturen en vormen kan detecteren, en dat hij die kennis kan toepassen op de nieuwe, moeilijkere taak van het identificeren van celtypen.
In een recente studie onderzochten onderzoekers hoe goed deze aanpak werkt voor een specifieke, moeilijke probleemstelling: het sorteren van baarmoederhalscellen in vijf verschillende categorieën. Deze categorieën omvatten cellen die voortijdig afsterven, cellen die geïnfecteerd zijn door een virus, cellen waarvan de structuur verandert, en twee typen gezonde cellen die vaak met elkaar worden verward. Het team verzamelde een collectie van meer dan vijfduizend hoogwaardige afbeeldingen van deze cellen. Om ervoor te zorgen dat hun resultaten eerlijk en betrouwbaar waren, verdeelden ze deze collectie in drie groepen: een grote groep om de computer te onderwijzen, een middelgrote groep om de voortgang tijdens de training te controleren, en een uiteindelijke, ongeziene groep om de kennis aan het einde te testen. Vervolgens trainden ze drie verschillende soorten computermodellen, elk gebaseerd op een beroemde architectuur die eerder was gebruikt om objecten in de natuur te identificeren. Deze modellen werden zorgvuldig aangepast met technieken om ervoor te zorgen dat ze evenveel aandacht besteedden aan de minder voorkomende celtypen als aan de veelvoorkomende.
De resultaten toonden aan dat de computermodellen inderdaad in staat zijn om tussen deze vijf celtypen te onderscheiden met een hoge mate van nauwkeurigheid. Een van de modellen, bekend als ResNet50, presteerde het best. Bij het testen op de laatste groep afbeeldingen die het nog nooit eerder had gezien, identificeerde het correct het celtype in meer dan negentig-één procent van de gevallen. Dit betekent dat de computer in negenennegentig van de honderd gevallen het juiste antwoord gaf. Het model was bijzonder goed in het onderscheiden van de twee typen gezonde cellen, die vaak het moeilijkst te scheiden zijn. Het had echter iets meer moeite met de cellen die geïnfecteerd waren door een virus of waarvan de structuur veranderde. Deze specifieke celtypen zijn van nature variabeler in hun uiterlijk, wat het moeilijker maakt voor welk systeem dan ook om ze perfect te categoriseren.
Om te begrijpen hoe de computer zijn beslissingen nam, gebruikten de onderzoekers een hulpmiddel dat de specifieke delen van een afbeelding markeert waar het model zich op concentreerde. Wanneer zij naar deze gehighlighte gebieden keken, zagen zij dat de computer inderdaad naar de cel zelf keek, in plaats naar de achtergrond of willekeurige ruis. Dit is een cruciale stap, omdat het bewijst dat het model de juiste zaken leert. Toch toonde de studie ook aan dat zelfs wanneer de computer zeer zeker was van zijn antwoord, hij niet altijd correct was. In sommige gevallen identificeerde de computer met veel vertrouwen een door een virus geïnfecteerde cel als een stervende cel, of andersom. Dit suggereert dat hoewel de technologie krachtig is, deze nog niet perfect genoeg is om een menselijke arts te vervangen. De onderzoekers benadrukken dat deze bevindingen een belangrijke stap voorwaarts vertegenwoordigen in het automatiseren van het screeningsproces, maar dat het geen definitieve oplossing is. De modellen werden getest op afbeeldingen van een enkele bron, terwijl de praktijk in de echte wereld medische monsters van veel verschillende laboratoria omvat, met verschillende microscopen en kleuringsmethoden.
De studie concludeert dat hoewel transfer learning een robuuste en effectieve manier biedt om geautomatiseerde systemen voor de classificatie van baarmoederhalscellen te bouwen, er nog werk te verrichten is voordat deze instrumenten veilig in een kliniek kunnen worden gebruikt. De computer heeft bewezen dat hij de visuele taal van deze cellen kan leren, maar de weg naar klinisch gebruik vereist verdere tests op diverse patiëntenpopulaties en een dieper begrip van waar het systeem nog steeds fouten maakt. Voor nu is de meest veelbelovende rol voor deze technologie die van een ondersteunend instrument, dat helpt de werklast van pathologen te verminderen en ervoor zorgt dat geen enkel subtiel teken van ziekte over het hoofd wordt gezien, in plaats van te fungeren als een onafhankelijke diagnosticus. De reis van een succesvol computerexperiment naar een levensreddend medisch apparaat is lang, maar dit onderzoek bevestigt dat het fundament solide is.
Verdrinkt u in papers in uw vakgebied?
Ontvang dagelijkse digests van de nieuwste papers die bij uw onderzoekswoorden passen — met technische samenvattingen, in uw taal.