Artificial Intelligence in Oral Squamous Cell Carcinoma Diagnosis: Exploring Deep Transfer Learning Strategies
Diese Studie zeigt, dass Deep Transfer Learning, insbesondere unter Verwendung der Modelle EfficientNetB7 und ResNet50, die durch Datenaugmentation und Kreuzvalidierung optimiert wurden, eine hochpräzise Klassifizierung von histologischen Bildern des oralen Plattenepithelkarzinoms erreicht und somit eine vielversprechende Lösung zur Verbesserung der diagnostischen Genauigkeit sowie zur Adressierung der Variabilität zwischen Pathologen bietet.
Originalarbeit lizenziert unter CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen
Stellen Sie sich vor, Sie sind ein Detektiv, der versucht, ein Rätsel zu lösen, aber anstatt nach Fingerabdrücken oder Fußabdrücken zu suchen, betrachten Sie winzige, farbenfrohe Bilder von Zellen unter einem Mikroskop. Dies ist die Welt der Pathologie, in der Ärzte Gewebeproben untersuchen, um festzustellen, ob eine Person Krebs hat. Einer der häufigsten und kniffligsten Krebse, die man finden kann, ist das orale Plattenepithelkarzinom (OSCC), eine Art von Krebs, der im Mund beginnt. Jahrzehntelang war der „Goldstandard“ zur Lösung dieses Rätsels ein menschlicher Pathologe, der auf eine Glasplatte starrte. Er suchte nach Hinweisen wie der Anordnung der Zellen oder danach, ob sie ungeordnet und chaotisch wirkten. Aber hier ist der Haken: Menschen werden müde, ihre Augen können ihnen Streiche spielen, und zwei verschiedene Detektive könnten auf dasselbe Bild schauen und sich uneinig darüber sein, was sie sehen. Hier kommt Künstliche Intelligenz (KI) ins Spiel. Betrachten Sie KI als einen supermächtigen Assistenten, der Millionen von Bilderbüchern gelesen hat und Muster erkennen kann, die dem menschlichen Auge entgehen könnten. Die große Frage, die sich Wissenschaftler stellen, ist: Können wir einen Computer dazu bringen, auf diese winzigen Zellbilder zu schauen und uns genau zu sagen, welche Art von Krebs es ist und wie gefährlich er ist – besser und schneller als ein Mensch?
Diese Studie gleicht einem Kochwettbewerb mit hohem Einsatz, aber anstelle von Köchen sind es Computermodelle und anstelle von Zutaten werden ihnen mikroskopische Bilder von Mundgewebe gefütert. Die Forscher wollten sehen, welcher „Koch“ (oder Deep-Learning-Modell) diese Bilder am besten in drei Kategorien sortieren kann: gesundes Mundgewebe, niedriggradiger Krebs (die langsamere, weniger gefährliche Art) und hochgradiger Krebs (die schnelle, aggressive Art). Um die Herausforderung fair zu gestalten, begannen sie mit einem kleinen Stapel von 750 Bildern. Da es nicht genug Bilder der seltenen „niedriggradigen“ und „hochgradigen“ Krebsarten gab, um die Computer richtig zu lehren, verwendeten sie einen cleveren Trick namens SMOTE. Stellen Sie sich vor, Sie hätten nur drei rote Murmeln und hundert blaue; es wäre schwierig, jemanden zu lehren, rote zu erkennen. SMOTE ist wie ein magischer Fotokopierer, der brandneue, künstliche, aber realistische rote Murmeln erstellt, damit der Computer genügend Übung bekommt. Sie verwendeten auch „Data Augmentation“, was so ist, als würde man ein Foto machen, es auf den Kopf stellen, heller machen oder leicht drehen, damit der Computer lernt, den Krebs zu erkennen, egal wie das Bild gehalten wird.
Die Forscher testeten sieben berühmte „Köche“ (Computermodelle), die bereits gelernt hatten, Millionen von Alltagsgegenständen wie Katzen, Autos und Äpfel zu erkennen. Diese Modelle waren ResNet50, InceptionV3, VGG16, EfficientNetB7, DenseNet121, Xception und MobileNet. Die Idee war, diese klugen Modelle zu „feintunen“, so als würde man einem General, der weiß, wie man Kriege führt, nun beibringen, sich auf ein spezielles Gelände zu spezialisieren. Sie taten dies, indem sie den Großteil des „Gehirns“ des Modells „einfroren“ (damit es nicht vergisst, was es bereits weiß), und nur die letzten paar Schichten lernten, aus den neuen Krebsbildern zu lernen. Sie probierten verschiedene Strategien aus, wie zum Beispiel 15 Schichten lernen zu lassen oder 30 Schichten, um zu sehen, was am besten funktionierte.
Das Ergebnis war ein klarer Sieg für ein spezifisches Modell: EfficientNetB7. Dieses Modell war der Star der Show und lieferte in 99,2 % der Fälle die richtige Antwort. Es war wie ein Detektiv, der nie einen Hinweis übersah. Der Zweitplatzierte war ResNet50, das ebenfalls unglaublich zuverlässig mit einer Erfolgsquote von 99,04 % war. Diese beiden Modelle bewiesen, dass Computer mit der richtigen Ausbildung extrem präzise darin sein können, diese spezifischen Krebsgrade aufzuspüren. Jedoch war nicht jedes Modell ein Gewinner. InceptionV3, das sehr schick klang, schnitt mit 92,94 % tatsächlich am schlechtesten ab, und MobileNet, das normalerweise großartig für kleine Geräte ist, erreichte nur 95,2 %. Die Studie legt nahe, dass, obwohl die Technologie unglaublich vielversprechend ist, das „Rezept“ eine große Rolle spielt; manche Modelle können die spezifischen Details dieser Zellbilder einfach besser verarbeiten als andere.
Die Autoren merken vorsichtig an, dass diese Zahlen zwar erstaunlich sind, die Modelle aber noch mit vielfältigeren Daten in der realen Welt getestet werden müssen. Sie weisen auch auf eine Einschränkung hin: Diese KI-Systeme sind wie „Black Boxes“. Sie können die Antwort mit hoher Zuversicht nennen, aber sie können nicht immer erklären, warum sie denken, dass eine Zelle gefährlich aussieht – etwas, das menschliche Ärzte verstehen müssen, bevor sie Entscheidungen über Leben und Tod treffen. Letztendlich legt diese Arbeit nahe, dass KI, insbesondere Modelle wie EfficientNetB7 und ResNet50, ein mächtiger Gehilfe für Pathologen werden könnte, der ihnen hilft, Mundkrebs mit übermenschlicher Geschwindigkeit und Genauigkeit zu diagnostizieren, aber noch nicht der Ersatz für den menschlichen Experten ist.
Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?
Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.