← Neueste Arbeiten
💻 computer science

Benchmarking Deep Learning and Vision Foundation Models for Atypical vs. Normal Mitosis Classification with Cross-Dataset Evaluation

Dieser Beitrag stellt einen umfassenden Benchmark für Deep-Learning- und Vision-Foundation-Modelle zur Klassifizierung atypischer gegenüber normaler Mitose bei Brustkrebs vor und zeigt, dass Transfer-Learning- und Fine-Tuning-Techniken Klassifizierungsherausforderungen sowohl in-domänen- als auch neu eingeführten out-of-domänen-Datensätzen wirksam begegnen.

Ursprüngliche Autoren: Sweta Banerjee, Viktoria Weiss, Taryn A. Donovan, Rutger H. J. Fick, Thomas Conrad, Jonas Ammeling, Nils Porsche, Robert Klopfleisch, Christopher Kaltenecker, Katharina Breininger, Marc Aubreville, Ch
Veröffentlicht 2026-04-30
📖 5 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Sweta Banerjee, Viktoria Weiss, Taryn A. Donovan, Rutger H. J. Fick, Thomas Conrad, Jonas Ammeling, Nils Porsche, Robert Klopfleisch, Christopher Kaltenecker, Katharina Breininger, Marc Aubreville, Christof A. Bertram

Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen

Stellen Sie sich vor, eine sich teilende Zelle ist wie ein Bäcker, der Teig knetet und ihn in zwei perfekte, identische Laibe aufteilt. Dies ist eine normale Mitose. Doch manchmal wird der Bäcker ungeschickt, der Teig reißt oder die Laibe fallen ungleichmäßig aus. Dies ist eine atypische Mitose. In der Welt des Krebses ist das Aufspüren dieser „ungeschickten Bäcker" ein wichtiger Hinweis darauf, dass ein Tumor möglicherweise aggressiv und gefährlich ist.

Das Auffinden dieser ungeschickten Bäcker ist jedoch für menschliche Pathologen (die Ärzte, die Mikroskoppräparate untersuchen) unglaublich schwierig. Sie sind selten, sehen den normalen sehr ähnlich, und selbst Experten sind sich oft uneinig darüber, was sie sehen. Es ist wie der Versuch, eine spezifische, leicht schief gestellte Nadel in einem riesigen Heuhaufen zu finden, wobei das Heu ständig die Farbe wechselt.

Diese Arbeit ist ein Wettlauf, um herauszufinden, welches Computerprogramm am besten darin ist, diese „ungeschickten Bäcker" zu entdecken.

Die Kandidaten: Drei verschiedene Strategien

Die Forscher organisierten einen Wettbewerb mit drei verschiedenen Arten von „Detektiven" (KI-Modellen), um zu sehen, wer dieses Rätsel am besten lösen kann:

  1. Die „Frisch-Start"-Detektive (End-to-End-Modelle): Diese sind wie die Einstellung eines klaren Praktikanten, dem man alles von Grund auf anhand eines spezifischen Lehrbuchs beibringt. Sie lernen die Regeln der Zellteilung vollständig aus den bereitgestellten Daten.
    • Die Modelle: EfficientNet, Vision Transformer (ViT) und Swin Transformer.
  2. Die „Experten-Bibliothekarinnen" (Foundation-Modelle mit Linear Probing): Stellen Sie sich eine Bibliothekarin vor, die Millionen Bücher über Biologie gelesen hat, aber noch nie gebeten wurde, ungeschickte Bäcker zu erkennen. Sie bitten sie, ein Bild anzusehen und einfach eine einfache Linie zu ziehen, um „ja" oder „nein" zu sagen. Sie nutzen ihr riesiges Allgemeinwissen, verändern aber ihr Gehirn nicht; sie fügen lediglich einen winzigen, einfachen Filter darüber hinzu.
    • Die Modelle: Riesige vortrainierte Modelle wie UNI, Virchow und H-Optimus.
  3. Die „Spezialisierten Lehrlinge" (Foundation-Modelle mit LoRA): Dies ist dieselbe Bibliothekarin, aber statt nur eine Linie zu ziehen, geben Sie ihr ein kleines, spezialisiertes Notizbuch (genannt LoRA), um spezifische Regeln für diesen Job aufzuschreiben. Sie behalten ihr riesiges Allgemeinwissen, lernen aber gerade genug neue Tricks, um Experten im Aufspüren ungeschickter Bäcker zu werden, ohne ihr gesamtes Gehirn neu schreiben zu müssen.

Die Testfahrt: Drei verschiedene Kurse

Um herauszufinden, wer wirklich der Beste ist, testeten die Forscher sie nicht nur an denselben Hausaufgaben, die sie gelernt hatten. Sie gaben ihnen drei verschiedene Prüfungen:

  • Die Übungsprüfung (AMi-Br): Dies war der Hauptdatensatz, der für das Training verwendet wurde. Er enthielt Tausende von Bildern menschlicher Brustkrebszellen.
  • Die „Gleiche Stadt, anderes Viertel"-Prüfung (AtNorM-Br): Hier wurden Bilder aus einer anderen Quelle (TCGA) verwendet. Es war wie der Test der Detektive in derselben Stadtart, jedoch mit unterschiedlichen Straßenschildern und Beleuchtung.
  • Die „Ausland"-Prüfung (AtNorM-MD): Dies war die härteste Prüfung. Sie umfasste nicht nur menschlichen Brustkrebs, sondern auch Hundetumoren und andere menschliche Krebserkrankungen. Es war wie der Versand der Detektive in ein völlig anderes Land mit unterschiedlichen Sprachen und Bräuchen, um zu sehen, ob sie immer noch die ungeschickten Bäcker finden konnten.

Die Ergebnisse: Wer hat gewonnen?

1. Die „Spezialisierten Lehrlinge" (LoRA) waren die klaren Gewinner.
Als den Foundation-Modellen (den Bibliothekarinnen) dieses kleine spezialisierte Notizbuch (LoRA) gegeben wurde, schnitten sie unglaublich gut ab. Das Virchow2-Modell mit LoRA war der Champion und erreichte die höchste Genauigkeit bei der Übungsprüfung. Es bewies, dass die Strategie, ein massives, allgemeines KI-System mit einer winzigen, spezifischen Anpassung zu versehen, sehr wirkungsvoll ist.

2. Die „Frisch-Start"-Detektive waren starke Vizemeister.
Die Modelle, die von Grund auf neu trainiert wurden (End-to-End), schnitten sehr gut ab, insbesondere bei der „Ausland"-Prüfung. Der Swin Transformer war hier der Beste und zeigte, dass manchmal ein engagiertes Team, das speziell für den Job trainiert wurde, neue, seltsame Situationen besser bewältigen kann als ein Generalist.

3. Die „Experten-Bibliothekarinnen" (Linear Probing) hatten Schwierigkeiten.
Als die Bibliothekarinnen versuchten, den Job ohne das spezialisierte Notizbuch zu erledigen (nur unter Verwendung einer einfachen Linie), schnitten sie schlecht ab. Es stellte sich heraus, dass ihr riesiges Allgemeinwissen nicht ausreichte, um diese spezifischen, subtilen Fehler ohne zusätzliche Schulung zu erkennen.

Die große Erkenntnis

Die Arbeit kommt zu dem Schluss, dass das Aufspüren dieser abnormalen Zellteilungen zwar eine schwierige Aufgabe ist, KI dies jedoch effektiv bewältigen kann.

Die wichtigste Lehre ist, dass wie man die KI trainiert, wichtiger ist als nur eine große KI zu haben.

  • Einem riesigen vortrainierten Modell einfach nur zu bitten, zu raten (Linear Probing), reicht nicht aus.
  • Dem riesigen Modell einen winzigen, effizienten Weg zu geben, die spezifische Aufgabe zu lernen (LoRA), wirkt Wunder.
  • Manchmal ist das Training eines Modells von Grund auf auf den spezifischen Daten immer noch eine sehr wettbewerbsfähige Strategie.

Die Forscher veröffentlichten zudem alle ihre Daten und ihren Code, übergeben im Wesentlichen die „Prüfungsfragen" und „Lösungsschlüssel" an den Rest der wissenschaftlichen Gemeinschaft, damit alle diese Detektiven weiter verbessern können. Sie stellten fest, dass die Modelle zwar gut sind, aber immer noch Schwierigkeiten haben, wenn das „Ausland" (unterschiedliche Gewebetypen oder Scanner) zu unterschiedlich ist, was darauf hindeutet, dass wir immer noch vielfältigere Daten benötigen, um diese Werkzeuge für jede Situation perfekt zu machen.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →