DeepHistoViT: An Interpretable Vision Transformer Framework for Histopathological Cancer Classification
该论文提出了 DeepHistoViT,这是一个可解释的视觉 Transformer 框架,它通过利用注意力机制来定位具有诊断相关性的区域,在肺癌、结肠癌和急性淋巴细胞白血病的组织病理学图像分类中实现了最先进的准确率和统计稳健性。
原始论文采用 CC BY 4.0 许可(https://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
癌症的诊断通常始于病理学家通过显微镜观察一小片组织切片,寻找异常细胞所呈现出的细微且混乱的模式。这种人工检查是确认癌症的金标准,但也是一个缓慢、耗时且容易因人类误差和疲劳而出错的过程。近年来,科学家们转向利用人工智能来提供帮助,教计算机识别这些危险的模式。早期的尝试依赖于观察局部细节的系统,就像是通过检查单块砖头来理解一面墙。然而,癌症往往通过大量细胞在广阔区域内的排列方式显现出来,这需要对整体图像而非仅仅是局部零件的理解。一种受计算机处理语言方式启发的新一代人工智能应运而生,旨在通过同时分析整幅图像来解决这一问题,寻找组织不同区域之间的长程联系。
埃克塞特大学的一组研究人员基于这种新方法,开发了一个名为 DeepHistoViT 的工具,专门用于读取这些复杂的医学图像。他们的工作聚焦于三种不同类型的癌症:肺癌、结肠癌以及一种被称为急性淋巴细胞白血病的血液癌症。他们并没有强迫计算机从零开始学习,而是从一个已经学会从数百万张日常照片中识别通用形状和物体的模型出发。随后,他们仔细调整了该模型,使其专注于癌变组织中独特的纹理和结构。研究人员在数千张图像上训练该系统,使其能够学习区分健康细胞与恶性细胞,而无需手动指出每一个特征。至关重要的是,他们设计该系统时要求其“展示其工作过程”;它可以高亮显示导致其诊断结论的切片中的特定位置,从而为医生提供验证计算机推理逻辑的方法。
在包含数千张图像的公开数据集上进行测试时,这个新系统表现出了卓越的精准度。在肺癌和结肠癌图像上,该模型取得了完美的分数,正确识别了测试组中的每一个样本。对于更为复杂的血液癌症数据集(其中包含更广泛的细胞形状和阶段),该系统的准确率仍达到了近 99.85%。这些结果并非偶然的猜测;研究人员多次使用不同的数据拆分方式运行测试,以确保结果的一致性和可靠性。该系统还证明了其处理未经化学标准化的图像的能力,这意味着它可以应对现实世界医院实验室中出现的颜色和光照的自然变化,而不需要完美的、统一的样本。
这项工作最显著的方面在于它如何解释自己的决策。不同于那些给出答案却不展示推导过程的“黑箱”旧模型,这个新框架使用了一种机制来高亮显示图像中最重要的部分。当研究人员观察视觉输出时,他们看到系统正聚焦于病理学家所关注的实际生物学特征,例如细胞核的形状以及细胞的排列方式。这种指向相关区域的能力建立了信任,因为它允许人类医生在做出最终判断前,看清计算机所看到的具体内容。研究人员发现,该系统学会了忽略无关的背景噪声,并精准锁定诊断细节,这模仿了受过训练的专家扫描切片的方式。
该研究还将这种新方法与其他目前正在使用的先进方法进行了对比。虽然其他系统也取得了极高的准确率(通常在 99% 左右),但新的框架在所有三种癌症类型上都达到或略微超过了这些数值。研究人员指出,在肺癌和结肠癌数据集上的表现尤为出色,尽管他们也提醒说,这些特定的图像集是基于数量有限的原始切片进行数字化扩充而成的。这意味着,虽然该系统在这些特定测试中非常有效,但其处理现实世界中海量且不可预测的患者样本的能力,仍需在大型临床医院中进行进一步验证。尽管如此,结果表明,这类人工智能正准备超越简单的模式匹配,开始理解组织健康的更广泛背景。
通过将观察全局的能力与解释其发现的能力相结合,DeepHistoViT 代表了使人工智能成为医生实用伙伴的一大进步。该系统并非取代病理学家,而是提供了一个既高度准确又透明的强大“第二意见”。随着研究人员展望未来,他们计划在规模更大、更多样化的患者群体中测试该工具,以确保它在每种临床环境下都能保持可靠。目前,这项工作证明了,当人工智能被设计为能够观察疾病的全貌并展示其推理过程时,它可以成为抗击癌症过程中值得信赖的盟友。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。