← 最新论文
📄 medicine

Comparison of DeepSeek, ChatGPT-4, and Online Medical Platforms in Addressing Chronic Pancreatitis Related Questions

本研究评估了 DeepSeek 和 ChatGPT-4 在回答慢性胰腺炎问题方面相对于传统在线医疗平台的表现,发现虽然这些 AI 模型能够提供与医生相当的准确且全面的基于指南的信息,但在提供实现高患者满意度所必需的共情式、个性化支持方面仍显不足。

原作者: Wanshun Li, Xinyi Su, Zhicheng Yang, Zhenghui Yang, Hanbin Zhu, Chao Liu, Deyu Zhang, Haojie Huang, Zhendong Jin

发布于 2026-07-20
📖 1 分钟阅读☕ 轻松阅读

原作者: Wanshun Li, Xinyi Su, Zhicheng Yang, Zhenghui Yang, Hanbin Zhu, Chao Liu, Deyu Zhang, Haojie Huang, Zhendong Jin

原始论文采用 CC BY 4.0 许可(https://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一下,你正站在一座宏伟而繁忙的图书馆里,书架上堆满了人类可能提出的每一个医学问题。几十年来,如果你想了解一个棘手的健康问题,你必须在尘封的百科全书中苦苦搜寻,或者排队等待一位可能正忙得不可开交的图书管理员来回答。但最近,一种新型的“图书管理员”来到了这里:人工智能(AI)。它们不仅仅是书籍;它们是超级聪明的数字大脑,能够在眨眼之间阅读数百万本医学教科书,并能与你进行即时聊天。每个人心中最大的疑问是:这些数字大脑真的能帮助我们了解自己的身体吗,还是它们只是会胡编乱造的高级聊天机器人?为了找出答案,科学家们正在将它们置于一项测试之中,其对照标准是医学建议的“金标准”:真实的医生以及他们遵循的官方规则手册。这并不是要取代医生,而是为了看看这些新的 AI 工具是否可以成为有力的“副手”,特别是对于那些正在应对长期且复杂疾病、只想获得清晰答案的人们。

在这项研究中,来自中国的一个研究小组决定让两个最著名的 AI “大脑”——DeepSeek 和 ChatGPT-4——进行一场面对面的竞争。他们想看看这些数字助手在回答关于一种被称为“慢性胰腺炎”的棘手疾病的问题时表现如何。把慢性胰腺炎想象成你胰腺(那个帮助消化食物和管理血糖的器官)中一种持续存在的、脾气暴躁的炎症,它不会轻易消失。它会导致疼痛、消化问题,甚至可能导致糖尿病。由于这种病非常复杂且令人沮丧,患者经常转向互联网寻求帮助,但互联网是一个狂野的地方,既有精辟的建议,也有危险的谬论。

研究人员设置了一个分为两部分的挑战。首先,他们根据 2020 年官方医学规则手册(美国胃肠病学会指南)向 AI 和真实医生提问,以测试 AI 是否掌握了事实知识。其次,他们向 AI 和医生输入了 40 个由真实患者提出的实际问题,涵盖了从“这种疼痛意味着什么?”到“我该如何管理饮食?”等所有内容。随后,这些回答由一组专家级胃肠病学家(专门研究肠道的医生)以及患者本人进行评分。专家们考察准确性、完整性和安全性,而患者则对回答的共情能力和满意度进行评分。

结果呈现出一种“惊叹”与“等等”并存的复杂局面。在涉及规则手册中的硬性事实时,DeepSeek 和 ChatGPT-4 的表现都非常出色,得分几乎与人类医生持平。事实上,DeepSeek 似乎在以一种非常有序、系统化的方式解释复杂概念方面颇有天赋,有时甚至比在线医生做得更好。然而,当研究人员观察患者问题时,情况变得更加微妙。虽然 AI 模型在准确性和安全性方面表现良好,但它们并不一定能让患者感到比人类医生更快乐或更被理解。事实上,所有对象(无论是 AI 还是人类)的满意度得分都仅仅是“还可以”,徘中立的中间水平。

一个有趣的转折是,AI 有时会在特定细节上失误。例如,在其中一个案例中,DeepSeek 最初对如何诊断该疾病给出了一个略微具有误导性的答案,但在被再次询问后进行了自我纠正。这表明,尽管 AI 功能强大,但它仍然会有些许摇摆,就像一个虽然掌握了知识但在考试时会紧张的学生。这项研究表明,这些 AI 工具在提供坚实的、事实性的基础和详细解释方面非常出色,使它们成为患者了解自己病情的极佳“补充工具”。但研究人员明确表示:它们不能取代真正的医生。“人文关怀”——即共情能力、阅读患者表情的能力以及做出最终决定的责任感——是 AI 目前仍无法完全复制的东西。

最终,论文得出结论,我们应该将这些 AI 模型视为一位知识渊博的学习伙伴。它们可以凭借惊人的速度和细节帮助你理解疾病的“是什么”和“为什么”,但你仍然需要一位人类医生来引导“如何做”以及“接下来怎么办”。未来看起来前景广阔,一个混合模式正蓄势待发:由 AI 处理繁重的资料处理工作,从而让医生能够专注于患者真正需要的护理与情感连接。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →