← 最新论文
💬 NLP

AI chatbots versus human healthcare professionals: a systematic review and meta-analysis of empathy in patient care

这项针对15项研究(2023–2024年)的系统综述和元分析显示,在基于文本的交互中,利用大语言模型的AI聊天机器人被认为比人类医疗专业人员具有显著更高的共情能力,尽管这些发现受到非言语线索缺失以及依赖代理评分者的限制。

原作者: Alastair Howcroft, Amber Bennett-Weston, Ahmad Khan, Joseff Griffiths, Simon Gay, Jeremy Howick

发布于 2026-02-06
📖 1 分钟阅读☕ 轻松阅读

原作者: Alastair Howcroft, Amber Bennett-Weston, Ahmad Khan, Joseff Griffiths, Simon Gay, Jeremy Howick

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

将医疗保健想象成一场巨大的、嘈杂的对话,医生试图理解患者的恐惧与痛苦。长期以来,我们一直认为只有人类才能真正与他人产生“情感共鸣”——即同理心是人类特有的特殊超能力。

这篇论文就像是一份对比两位老师的详尽成绩单:人类医生AI聊天机器人(特别是像ChatGPT这样编写文本的机器人)。研究人员想要看看,当患者寻求帮助时,谁能写出更具关怀感、理解力的信息。

以下是研究结果的简单拆解:

大赛测试:谁听起来更具关怀感?

研究人员收集了2023年和2024年的15项不同研究。在这些研究中,他们提取了患者提出的真实问题(例如“我的皮肤很痒”或“我担心我的检查结果”),并要求人类医生和AI分别撰写回复。

随后,他们聘请了“评委”(可以是其他医生、学生或普通人)在不知道作者身份的情况下阅读这些回复。评委对信息的同理心、友善程度和理解程度进行了评分。

结果:
15次比较中,AI聊天机器人在13次中胜出

  • 这就像是一场味觉测试:如果你蒙上眼睛,让人猜哪块饼干是由名厨制作的,而哪块是由机器人制作的,那么在这个特定的测试中,机器人的饼干会更常胜出。
  • AI不仅仅是微弱领先;它的优势非常显著。研究人员计算出,在10分制量表中,AI的信息比人类医生的信息感觉要“温暖”约2分

“仅限文本”的限制

这里有一个非常重要的细节。整个比赛完全是在纯文本环境下进行的。

  • 想象一下一次电话通话,你看不见对方的脸,也听不到对方的语调。这就是这些测试的情况。
  • 人类医生通常通过点头、身体前倾或使用柔和的声音来展现同理心。而AI无法做到这些,因为它只有屏幕上的文字。
  • 论文指出,在两个特定领域(皮肤病学/皮肤科),人类医生实际上赢得了比赛。在其他13个案例中,AI的文本被认为更具关怀感。

为什么AI会赢?

论文提出了几个可能的理由,尽管它并未表示AI拥有“灵魂”:

  1. 一致性: AI永远不会有“状态不佳”的时候。它不会感到疲劳、压力或分心。它始终能写出礼貌、结构清晰且具有支持性的信息。
  2. “完美”的草稿: AI似乎非常擅长使用那些能让人们感到被倾听的“魔法词汇”,比如“我理解这很困难”或“我很遗憾你正在经历这些”。
  3. 人类的不完美性: 现实中的医生非常忙碌。有时他们的书面记录很简短、临床化或显得仓促,因为他们的重心在于医学事实。而AI没有其他工作,因此它能全身心地投入到语气表达上。

“盲测”的问题

这项研究的一个重要部分是,评委并不知道作者是谁。他们当时想的是:“这段话听起来如此亲切,这一定是一位优秀的医生!”

  • 论文警告说,如果评委知道写下这段话的是机器人,他们的感受可能会有所不同。这就像是你很喜欢一首歌,但随后发现它是用电脑制作的,你可能就不会那么喜欢它了。该研究并未测试这种“已知AI”的情境,因此我们还不清楚如果人们知道那是机器写的,AI是否还能胜出。

这篇论文没有说的事情

请务必紧扣论文实际提出的观点:

  • 并没有说AI在医学方面更胜一筹。论文只关注了同理心(文字听起来多么具有关怀感),而非其提供的医学建议是否正确。事实上,论文警告说,如果AI给出了错误的医疗建议,那么表现得“友善”并无济于事。
  • 并没有说AI应该取代医生。论文建议采用一种“团队”协作模式,即AI可以辅助起草富有关怀感的文字部分,但人类医生应当负责核实事实。
  • 并没有说这适用于语音通话。该研究仅针对文本。我们目前还不知道AI语音助手在电话中是否能像人类一样听起来同样具有同理心。

底线结论

这篇论文挑战了一个旧观念:即只有人类才能在书面表达中体现同理心。在短信和在线表格的世界里,AI聊天机器人(特别是那些更新、更智能的机器人)目前编写的信息,在人们看来比平均水平的人类医生更具关怀感和理解力。

然而,这仅仅是“文本领域”的胜利。真正的医疗保健涉及面部表情、声音和复杂的医学事实,论文指出,在宣布机器人获胜之前,我们需要在这些领域进行更多的研究。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →