← Neueste Arbeiten
🧬 biology

Application of H&E images combined with gene expression data-driven multimodal deep learning models in gastric cancer prognosis

Diese Studie stellt PGC-pro vor, ein multimodales Deep-Learning-Modell, das H&E-Histopathologiebilder, Genexpressionsprofile und klinische Daten integriert, um die prognostische Genauigkeit und Interpretierbarkeit bei Magenkrebs im Vergleich zu unimodalen Ansätzen signifikant zu verbessern.

Ursprüngliche Autoren: Bo Yang, Hongyi Cai, Hao Li

Veröffentlicht 2026-09-07
📖 6 Min. Lesezeit🧠 Tiefgang

Ursprüngliche Autoren: Bo Yang, Hongyi Cai, Hao Li

Originalarbeit lizenziert unter CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). ⚕️ Dies ist eine KI-generierte Erklärung eines Preprints, das nicht peer-reviewed wurde. Dies ist kein medizinischer Rat. Treffen Sie keine Gesundheitsentscheidungen auf Grundlage dieses Inhalts. Vollständigen Haftungsausschluss lesen

Magenkrebs, oft auch als Magenkarzinom bezeichnet, bleibt eine der gewaltigsten gesundheitlichen Herausforderungen weltweit und fordert jedes Jahr Hunderttausende von Menschenleben. Seit Jahrzehnten verlassen sich Ärzte auf ein System namens TNM-Staging, um vorherzusagen, wie ein Patient seinen Verlauf nehmen wird. Dieses System fungiert wie eine Landkarte, die die Größe eines Tumors und dessen Ausbreitung zu benachbarten Lymphknoten oder fernen Organen kartiert. Während diese Karte zwar essenziell ist, bleibt sie unvollständig. Sie beschreibt das physische Ausmaß der Erkrankung, übersieht jedoch oft die einzigartige biologische Persönlichkeit des Krebses selbst. Zwei Patienten mit Tumoren derselben Größe und Lage können völlig unterschiedliche Verläufe haben, weil ihre Krebserkrankungen auf mikroskopischer Ebene unterschiedlich agieren. Um diese Lücke zu schließen, wenden sich Wissenschaftler an zwei kraftvolle Informationsquellen, die traditionell getrennt gehalten wurden: die visuellen Muster, die unter einem Mikroskop sichtbar sind, und die molekularen Anweisungen, die im Inneren der Zellen geschrieben stehen. Die eine Quelle ist der H&E-Schnitt, ein Standard-Objektträger, bei dem ein dünner Gewebeschnitt mit rosa und violetten Farbstoffen angefärbt wurde, um die Form und Anordnung der Zellen offenzulegen. Die andere ist die Genexpressionsdaten, ein digitaler Datensatz darüber, welche Gene innerhalb des Tumors aktiv sind, was wie ein molekularer Fingerabdruck wirkt. Die Herausforderung bestand darin, diese zwei sehr unterschiedlichen Arten von Informationen – Bilder und Zahlen – zu einem einzigen, kohärenten Bild zu kombinieren, das einem Arzt genau sagen kann, wie gefährlich der Krebs eines spezifischen Patienten wahrscheinlich ist.

In einer kürzlich durchgeführten Studie gingen Forscher des Qinghai University Affiliated Hospital diese Herausforderung an, indem sie ein neues Modell entwickelten, das darauf ausgelegt ist, gleichzeitig aus der visuellen und der molekularen Welt zu lernen. Sie nannten ihre Kreation PGC-pro, ein System, das nicht nur die Form eines Tumors oder seine Gene isoliert betrachtet, sondern untersucht, wie sie miteinander kommunizieren. Das Team begann mit Daten von 318 Patienten, die wegen Magenkrebs behandelt worden waren. Für jeden Patienten sammelten sie drei Dinge: einen digitalen Scan des gesamten Tumor-Objektträgers, eine Liste darüber, wie aktiv tausende Gene in diesem Tumor waren, und die klinische Vorgeschichte des Patienten, einschließlich Alter und Krankheitsstadium. Zuerst lehrten die Forscher den Computer, die wichtigsten Teile der mikroskopischen Bilder zu erkennen. Mit einer Methode, die die Arbeitsweise eines Pathologen beim Scannen eines Objektträgers nachahmt, lernte das System, leere Räume zu ignorieren und sich stattdertdessen auf die dicht besiedelten Bereiche zu konzentrieren, in denen Krebszellen in gesundes Gewebe eindringen. Gleichzeitig durchsiebte der Computer die genetischen Daten, um die spezifischen Gene zu finden, die am stärksten mit der Überlebensdauer der Patienten verknüpft waren, und schränkte die tausenden Möglichkeiten auf eine Kerngruppe von 150 Genen ein, die wirklich entscheidend waren.

Die zentrale Innovation dieser Arbeit liegt darin, wie der Computer diese beiden Informationsströme miteinander verbindet. Anstatt die Bilddaten einfach neben die Gendaten zu stapeln, nutzt das Modell einen Mechanismus, der es den beiden ermöglicht, sich gegenseitig Fragen zu stellen. Stellen Sie sich vor, die Bilddaten fragen die Gendaten: „Welche molekularen Veränderungen finden in diesem spezifischen Zellcluster statt?“, während die Gendaten den Bilddaten fragen: „Wie sieht das Gewebe dort aus, wo diese Gene am aktivsten sind?“ Dieser wechselseitige Austausch ermöglicht es dem Modell, tiefe Verbindungen zu finden, die keine der beiden Seiten allein sehen könnte. Das Modell könnte beispielsweise lernen, dass eine bestimmte ungeordnete Anordnung von Zellen im Bild fast immer mit einer hohen Aktivität bestimmter Gene einhergeht und dass diese spezifische Kombination ein starkes Warnsignal für einen schlechten Ausgang ist. Durch die Integration dieser visuellen und molekularen Hinweise mit dem Alter und dem Krankheitsstadium des Patienten generiert das Modell einen einzelnen Risiko-Score für jede Person.

Die Ergebnisse dieses Ansatzes waren klar und messbar. Als die Forscher das Modell mit den Patientendaten testeten, erwies es sich als signifikant besser in der Vorhersage des Überlebens als jede Methode, die nur eine Art von Information verwendete. Ein Modell, das nur die Gene betrachtete, konnte den Verlauf mit einem gewissen Grad an Genauigkeit vorhersagen, und ein Modell, das nur die Bilder betrachtete, schnitt etwas schlechter ab, aber das kombinierte Modell übertraf beide. Das System erreichte einen Wert, der auf eine hohe Fähigkeit hindeutet, Patienten korrekt nach ihrem Sterberisiko zu ordnen – ein Wert, der deutlich anstieg, wenn alle drei Datenquellen gemeinsam verwendet wurden. Wichtiger noch: Das Modell agierte nicht als mysteriöse „Black Box“, die eine Antwort ohne Erklärung liefert. Die Forscher bauten Werkzeuge ein, die es ihnen ermöglichten, genau zu sehen, worauf der Computer achtete. Sie konnten Heatmaps erstellen, die zeigten, auf welche Teile des Tumor-Objektträgers sich das Modell konzentrierte, und diese Karten hoben konsistent die Ränder des Tumors hervor, an denen er in gesundes Gewebe eindringt, sowie Bereiche mit abgestorbenen Zellen. Sie konnten auch sehen, welche Gene die Vorhersage vorantrieben, und identifizierten spezifische molekulare Marker, die das Modell als kritisch gelernt hatte. Diese Transparenz ist lebensnotwendig, da sie Ärzten erlaubt, dem Urteil des Computers zu vertrauen, indem sie die biologische Evidenz hinter seiner Entscheidung sehen können.

Die Studie testete auch, wie gut das Modell Bestand hätte, wenn es Vorhersagen über die Zeit hinweg treffen müsste. Es schätzte die Überlebenswahrscheinlichkeiten nach einem, drei und fünf Jahren erfolgreich ein und behielt seine Genauigkeit über diese verschiedenen Zeiträume hinweg bei. Als die Patienten basierend auf den Scores des Modells in Hochrisiko- und Niedrigrisikogruppen aufgeteilt wurden, war der Unterschied in ihren tatsächlichen Überlebensraten eklatant und statistisch signifikant, was bestätigte, dass das Modell effektiv zwischen jenen unterscheiden konnte, die wahrscheinlich gut zurechtkommen würden, und jenen, die es nicht tun würden. Die Forscher merkten an, dass das Modell zwar gut performte, aber auf einer einzigen Datenbank von Patientenakten trainiert wurde und seine Fähigkeit, bei Patienten aus anderen Krankenhäusern oder Regionen zu funktionieren, noch getestet werden muss. Sie räumten auch ein, dass die verwendeten Bilder gelegentlich Imperfektionen aufwiesen, wie etwa eine ungleichmäßige Färbung, was die Sicht des Computers beeinflussen könnte. Trotz dieser Einschränkungen zeigt die Arbeit, dass die Kombination der visuellen Geschichte eines Tumors mit seiner molekularen Geschichte ein weitaus mächtigeres Werkzeug zum Verständnis der Krankheit schafft. Indem sie beweist, dass diese verschiedenen Arten von Daten verwoben werden können, um ein klareres Bild der Zukunft zu zeichnen, bietet diese Forschung einen vielversprechenden Weg zu einer persönlicheren und präziseren Versorgung für Patienten, die mit Magenkrebs konfrontiert sind.

Ertrinken Sie in Arbeiten in Ihrem Fachgebiet?

Erhalten Sie tägliche Digests der neuesten Arbeiten passend zu Ihren Forschungsbegriffen — mit technischen Zusammenfassungen, in Ihrer Sprache.

Digest testen →