CytoFormer: A Molecularly Supervised Cell Foundation Model for Histopathology Cell Classification
CytoFormer ist ein neuartiges Zell-Foundation-Modell, das gepaarte H&E-Histologie und räumliche Transkriptomik-Daten aus 16 Organen nutzt, um eine präzise, label-effiziente und generalisierbare Zellklassifizierung zu erreichen, ohne auf manuelle pathologische Annotationen angewiesen zu sein.
Originalarbeit lizenziert unter CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Dies ist eine KI-generierte Erklärung des untenstehenden Papers. Sie wurde nicht von den Autoren verfasst oder gebilligt. Für technische Genauigkeit konsultieren Sie das Originalpaper. Vollständigen Haftungsausschluss lesen
In der Welt der Medizin ist die gängigste Methode, in den menschlichen Körper hineinzusehen, das Mikroskop, bei dem dünne Gewebeschnitte untersucht werden, die mit rosa und violetten Farbstoffen angefärbt sind. Dies ist der Standard der medizinischen Versorgung, um Krankheiten wie Krebs zu diagnostizieren. Ein Pathologe betrachtet diese Objektträger und identifiziert die verschiedenen vorhandenen Zelltypen – ob es sich um gesundes Gewebe, eindringende Immunzellen oder bösartige Tumorzellen handelt. Diese visuelle Inspektion ist leistungsstark, aber sie ist auch langsam, subjektiv und schwer skalierbar. Das Zählen von Millionen einzelner Zellen mit bloßem Auge ist unmöglich, und selbst Experten können sich uneinig darüber sein, was eine bestimmte Zelle ist, insbesondere wenn verschiedene Zelltypen unter einem Mikroskop nahezu identisch aussehen. Seit Jahrzehnten ist der Traum, Computer dazu zu bringen, dieses Zählen automatisch durchzuführen, doch der Bau eines solchen Computers steckte in einem Engpass fest: Er erfordert einen menschlichen Experten, der Millionen von Zellen von Hand beschriftet, um der Maschine beizubringen, wonach sie suchen muss. Diese manuelle Arbeit ist mühsam, teuer und oft unzuverlässig, was dazu führt, dass es dem Feld an hochwertigen Daten mangelt, um wirklich intelligente Systeme zu trainieren.
Ein Forschungsteam der University of Pennsylvania hat einen Weg gefunden, diesen menschlichen Engpass vollständig zu umgehen. Anstatt Pathologen zu bitten, Zellen zu beschriften, nutzten sie eine andere Art von biologischer Karte, um den Computer zu lehren. Sie kombinierten die standardmäßigen rosa-violetten Gewebeschnitte mit einer neueren Technologie namens räumliche Transkriptomik, die wie ein molekularer Barcodescanner fungiert. Dieser Scanner liest die genetische Aktivität innerhalb jeder einzelnen Zelle aus, während sie sich noch im Gewebe befindet. Da der genetische Code einzigartig für die Identität einer Zelle ist, sagt er den Forschern genau, um welchen Zelltyp es sich handelt, ohne dass ein Mensch raten muss. Durch das Abgleichen dieser molekularen Identitäten mit den entsprechenden Bildern auf den Standard-Objektträgern schuf das Team einen massiven, selbstüberwachten Datensatz. Sie nutzten diesen, um ein neues KI-Modell namens CytoFormer zu trainieren, das lernte, Zelltypen allein durch das Betrachten der Form und Textur der Zellen in den routinemäßigen Mikroskopbildern zu erkennen.
Das Ergebnis ist ein System, das Zelltypen mit einer Genauigkeit identifizieren kann, die mit der menschlicher Experten konkurriert, jedoch ohne dass ein Mensch während des Trainings auch nur ein einziges Kästchen um eine Zelle zeichnen musste. Die Forscher stellten Daten aus 81 verschiedenen Gewebeschnitten zusammen, die 16 verschiedene Organe des menschlichen Körpers abdecken, die von der Brust und der Lunge bis hin zum Gehirn und dem Knochenmark reichen. Insgesamt verarbeiteten sie mehr als 15 Millionen einzelne Zellen. Für jede Zelle lernte der Computer, das visuelle Erscheinungsbild im gefärbten Bild mit der spezifischen molekularen Identität zu verknüpfen, die durch den genetischen Scanner bereitgestellt wurde. Dies ermöglichte es dem Modell, eine universelle Sprache der Zellformen zu erlernen, die für den gesamten Körper funktioniert. Bei Tests an neuen Gewebeschnitten, die das Modell zuvor noch nie gesehen hatte, identifizierte es die Zelltypen in durchschnittlich 85 Prozent der Fälle korrekt. Wichtiger noch: Das Modell zählte nicht nur Zellen; es rekonstruierte die gesamte Architektur des Gewebes, indem es korrekt kartierte, wo sich Tumore, Immunzellen und gesunde Strukturen befanden, und bildete so die biologische Landschaft des Organs effektiv nach.
Was diese Entdeckung besonders bedeutsam macht, ist, wie gut das Modell sein Wissen auf neue Situationen überträgt. Die Forscher testeten, ob die KI in der Lage ist, Organe und Zelltypen zu handhaben, die sie während ihres Trainings nie zuvor encountert hatte. Sie wandten das Modell auf vier verschiedene öffentliche Datensätze an, die Zellen aus Organen wie dem Dickdarm und der Haut enthielten, welche nicht Teil des ursprünglichen Trainingssets waren. Selbst ohne diese spezifischen Gewebe zuvor gesehen zu haben, übertraf das Modell sechs andere führende Systeme der künstlichen Intelligenz, die auf Millionen manuell beschrifteter Bilder trainiert worden waren. Es war besonders effektiv in schwierigen Szenarien, in denen Zellen sich sehr ähnlich sehen, wie etwa bei der Unterscheidung zwischen normalem gesundem Gewebe und krebsartigem Gewebe, das dieses imitiert. In einem Test lernte das Modell, normale Zellen zu entdecken, die unter täuschend ähnlich aussehenden Tumorzellen verborgen waren, indem es nur wenige hundert von einem Menschen bereitgestellte Beispiele nutzte, während andere Systeme viel mehr Beispiele benötigten, um dieselbe Genauigkeit zu erreichen. Dies deutet darauf hin, dass das Modell die grundlegenden visuellen Regeln erlernt hat, wie Zellen in ihrer Umgebung aussehen, anstatt nur eine Liste spezifischer Zelltypen auswendig zu lernen.
Die Forscher untersuchten auch, wie viel vom umliegenden Gewebe der Computer sehen muss, um eine korrekte Identifizierung vorzunehmen. Sie testeten verschiedene Größen des Bildfensters um jede Zelle herum, von einer winzigen Ansicht, die nur die Zelle selbst zeigt, bis hin zu einer großen Ansicht, die die gesamte Nachbarschaft zeigt. Sie fanden heraus, dass das Modell am besten funktionierte, wenn es die Zelle und ihre unmittelbaren Nachbarn sehen konnte, aber nicht den gesamten Gewebeschnitt. Dieses Gleichgewicht ermöglichte es dem Computer, den Kontext der Zelle zu verstehen – ob sie in einem Blutgefäß, einer Tumormasse oder einer gesunden Drüse saß – ohne die feinen Details der Form der Zelle selbst zu verlieren. Diese spezifische Fenstergröße, die einer sehr kleinen, aber klaren Sicht auf die Zelle entspricht, erwies sich als der ideale Mittelweg für die Genauigkeit.
Indem sie die molekularen Daten des genetischen Scanners in ein Werkzeug zur visuellen Erkennung verwandelten, hat das Team eine wiederverwendbare Ressource geschaffen, die auf jeden routinemäßigen Gewebeschnitt angewendet werden kann. Das Modell benötigt keine teure neue Ausrüstung für den Betrieb; es kann Standard-Objektträger analysieren, die bereits jeden Tag in Krankenhäusern verwendet werden. Die Forscher haben den Code und das trainierte Modell der wissenschaftlichen Gemeinschaft zur Verfügung gestellt, damit andere diese neue Art des Zellsehns zu nutzen können. Obwohl das aktuelle Modell einige sehr ähnliche Zellen, wie etwa verschiedene Arten von Immunzellen, zusammen gruppiert, weil sie sich ähnlich sehen, stellt es einen bedeutenden Schritt nach vorn dar. Es beweist, dass wir leistungsfähige Werkzeuge zur zellulären Analyse bauen können, ohne auf den langsamen und teuren Prozess der manuellen Beschriftung angewiesen zu sein. Dieser Ansatz öffnet die Tür zur Analyse von Millionen von Zellen bei tausenden von Patienten und verwandelt routinemäßige Mikroskop-Objektträger in detaillierte Karten der zellulären Aktivität, die Ärzten helfen könnten, Krankheiten früher und genauer zu diagnostizieren.
Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?
Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.