← 最新论文
📄 medicine

Interpretable Fundus Image Classification via Ring-Based Retinal Vasculature Features

本研究提出了一种可解释的眼底图像分类框架,该框架利用基于环形的视网膜血管描述符,在实现与大规模预训练模型相当的性能的同时,提供了更高的透明度,并且仅需极少的特定任务训练数据。

原作者: Xiaoyan Li, Shixin Xu, Arvind Gupta, Huaxiong Huang

发布于 2026-09-08
📖 1 分钟阅读☕ 轻松阅读

原作者: Xiaoyan Li, Shixin Xu, Arvind Gupta, Huaxiong Huang

原始论文采用 CC BY 4.0 许可(https://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

每天都有数百万人依赖视网膜眼底摄影技术——这是一种专门捕捉眼底图像的相机技术——来筛查威胁视力的疾病。这张简单的图像包含了关于人体健康的丰富信息,特别是针对糖尿病视网膜病变和青光眼等疾病,这些疾病是导致全球失明的主要原因。几十年来,医生通过肉眼检查这些照片,寻找供应视网膜的精细血管网络中出现的细微变化。他们检查血管是否变得过宽、过扭曲或颜色发生改变,利用这些视觉线索来诊断疾病。然而,这种人类的判断可能因医生而异,而且庞大的图像数量使得持续、快速的筛查变得困难。近年来,被称为深度学习模型的强大计算机程序已被训练用于自动读取这些图像,其准确率往往能达到甚至超过人类水平。然而,这些程序运作起来就像“黑箱”一样;它们基于复杂且隐藏的模式做出诊断,而这些模式是人类无法看见或理解的,这让医生对计算机为何得出某种结论感到困惑。

来自多伦多大学、昆山杜克大学和约克大学的研究人员开展的一项新研究提供了一条不同的路径。该研究并没有依赖隐藏的模式,而是开发出一种将眼部图像分解为一系列同心圆环的方法,就像树木的年轮一样,以视神经盘(即主要血管进入眼睛的地方)为中心。通过测量每个圆环内血管的具体且可理解的特征——例如它们的粗细、分支方式、颜色以及它们与周围组织的对比度——团队创建了一张清晰、透明的眼部血管健康图谱。这种方法不仅能告诉医生患者是否患有疾病,还能解释究竟是血管网络的哪些部分以及哪些具体的物理特征导致了这一结论。研究人员发现,这种依赖直接测量而非隐藏算法的方法,可以高精度地分类眼部疾病,其表现既能匹配最先进、最复杂的计算机模型,又对人类观察者完全透明。

这项工作的核心在于研究人员如何组织信息。他们将眼底图像划分为从视神经盘向外辐射的圆形区域。在每个区域中,他们计算了四种不同类型的信息。首先,他们测量了血管的几何结构,统计了出现了多少个分支以及血管覆盖了多少面积。第二,他们分析了血管的颜色,观察红光与绿光的平衡情况,这可以指示血液携带了多少氧气。第三,他们检查了血管紧邻区域的纹理,检查背景中是否存在可能预示疾病的细微变化。最后,他们将这些测量结果组合成每张图像的一个单一且紧凑的数字集。这个过程将一张复杂、多彩的照片转化为一组结构化的事实列表,以便简单的计算机分类器进行读取。其结果是一个不仅准确而且具有可解释性的系统,允许医生清楚地看到哪个圆环或哪种特征对诊断贡献最大。

当研究人员在三个不同的公开眼部图像集上测试这个基于圆环的系统时,结果令人瞩目。在一个包含专家绘制血管图的高质量图像数据集中,该方法达到了完美的准确率。在另一个更具挑战性、质量较低的数据集中,它的表现依然异常出色,达到了在超过160万张视网膜图像上进行过训练的顶尖人工智能模型 RETFound 的准确度。这一对比具有重要意义,因为它表明研究人员这种简单、透明的方法可以与大规模、复杂的深度学习模型相竞争,而无需海量的数据或计算能力。事实上,研究表明,这些强大的深度学习模型有时可能会依赖“捷径”。当研究人员改变图像的背景或改变可见视野的大小时,深度学习模型的性能显著下降。这表明这些先进的模型有时是在捕捉与拍摄方式相关的线索(例如相机设置或特定的构图),而非仅仅是生物学上的疾病迹象。相比之下,基于圆环的方法保持了稳定性,因为它严格专注于血管本身的物理属性。

研究还探讨了初始血管图的质量如何影响最终诊断。在计算机需要自动猜测血管位置的情况下,准确率比专家提供地图时略低,但仍然非常强劲。这表明虽然精确的血管检测很重要,但该方法足以应对现实世界中图像质量的变化。此外,研究人员发现不同类型的特征有着不同的作用方式。例如,与颜色和氧合作用相关的测量值提供了仅靠几何结构无法捕捉到的独特信息。当他们在模型中移除这些基于颜色的特征时,准确率明显下降,证明了形状、颜色和纹理的结合对于构建完整图像至关重要。

或许最重要的一点是,研究人员展示了他们的方法是如何被理解的。他们创建了视觉热图,突出了支持诊断结论的特定眼部圆环。对于健康的眼睛,系统会指向血管模式符合健康常态的特定圆环;对于患病眼睛,它会标出血管过细、过扭曲或颜色错误的圆环。这种透明度是深度学习模型难以提供的。深度学习模型可能会说“这是青光眼”,但通常无法解释原因。然而,基于圆环的方法可以说明:“这是青光眼,因为靠近视神经盘的圆环中的血管明显比平时更细。”这种将诊断直接与可测量的物理变化联系起来的能力,使该工具不仅适用于筛查,也适用于理解疾病的进展。

研究人员也谨慎地指出了他们工作的局限性。该方法取决于能否首先准确识别血管;如果图像过于模糊或血管过于微弱,测量结果可能会不太可靠。他们还承认,他们的颜色测量是相对的,并未经过绝对生理标准的校准,这意味着它们最适合用于比较图像,而非测量精确的氧水平。尽管存在这些限制,这项研究仍为医学成像的未来指明了一个充满希望的方向。通过回归眼部的基本、可观察的属性,并以一种镜像人类解剖学理解的方式对其进行组织,研究人员创造了一个既强大又透明的工具。它提供了一种既能利用计算机的速度,又不丢失对诊断信任和理解能力的方法,弥合了复杂数据与临床洞察之间的鸿沟。在人工智能日益复杂的时代,这项工作提醒我们,有时最有效的工具是那种能与使用它的医生说同一种语言的工具。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →