The role of Artificial Intelligence in interventions to reduce physical inactivity: A systematic review
这项针对17项随机对照试验的系统评价发现,没有强有力的证据表明人工智能辅助干预能显著减少高收入国家的体力活动不足,尽管它们可能会适度增加步数,同时也强调了未来研究需要解决方法学局限性和公平性问题。
原始论文采用 CC BY 4.0 许可(https://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象一下,你正试图让整座城市的人都多走走路。你知道活动身体对健康有益,但让人们离开沙发却很难。多年来,公共卫生专家一直尝试利用技术来提供帮助,比如发送短信或使用应用程序。现在,随着**人工智能(AI)**的兴起,一个大问题出现了:一个聪明的计算机程序是否比普通的应用程序或人类教练更能说服我们去运动?
这篇论文就像是一个侦探故事,一群来自英国及其他地区大学的研究人员进行了一场大规模的搜寻,试图寻找答案。他们搜寻了从 2010 年到 2025 年初所有关于测试旨在让人们动起来的 AI 工具的科学研究。
以下是他们的发现,通过简单的概念进行了拆解:
1. 侦探工作(搜索过程)
研究人员不仅仅是看了一两个研究;他们筛选了近 20,000 条潜在的线索(标题和摘要),并阅读了 2,400 份完整的报告。最终,他们发现了 17 个真实的实验(试验),涉及大约 3,300 人。
把这 17 个试验想象成科学实验室里的 17 个不同“实验”。有些测试的是聊天机器人(你可以与之交谈的数字角色),而另一些测试的是智能推荐系统(这些系统会学习你喜欢什么样的信息,并在完美的时机发送给您)。
2. 主要角色:聊天机器人 vs. 智能推荐器
研究人员将 AI 工具分为两大类:
聊天机器人: 它们就像你可以发短信交流的数字朋友。有些只是简单的规则遵循者(类似于“选择你自己的冒险”类书籍),而另一些则稍微聪明一些,利用语言模型听起来更像人类。
- 结论: 聊天机器人大多表现得沉默寡言。它们似乎并没有让人们走得更多或运动更多。无论聊天机器人是一个友好的机器人还是一个严厉的教练,结果都是一样的:活动水平没有发生实质性的变化。
智能推荐器: 它们就像是运动信息的“私人购物员”。它们利用 AI 来搞清楚:“嘿,这个人喜欢跑步,所以让我们在周二早上发送一条跑步小贴士,”或者“这个人累了,让我们发一个温柔的提醒。”
- 结论: 这些工具展现出了一丝希望的火花,但仅限于一个特定方面:步数。其中一些智能系统确实帮助人们每天多走了几步。然而,当涉及到实际进行更高强度运动(如跑步或游泳)或增加整体活动时间时,智能推荐器的效果并不比普通应用程序更好。
3. “模糊照片”问题(为什么结果不可靠)
尽管研究人员发现了一些关于步数可能增加的迹象,但他们警告我们不要现在就过于兴奋。他们将这些证据描述为一张**“模糊的照片”**。
- 样本量小: 大多数实验规模都很小。想象一下,如果你只询问 10 个人来判断一种新饮食法是否有效。很难确定结果是真实的还是仅仅因为运气好。
- 数据混乱: 许多研究都存在问题。有些人退出了研究,有些人没有正确填写调查问卷,而且衡量“运动”的方式各不相同(有些使用计步器,有些只是让人凭感觉猜测)。
- 没有“超级 AI”: 有趣的是,没有一项研究使用了我们今天所听到的那种“超级聪明”的 AI(例如能写文章或像人类一样聊天的超大规模语言模型)。这些研究中使用的 AI 是“旧一代”的智能工具。
4. 大局结论
如果你想用一句话来总结这些发现,那就是:“我们还没有强有力的证据证明 AI 是让人们运动的魔杖。”
- 它奏效了吗? 对于一般的运动来说,并没有真正奏效。
- 它对步数有帮助吗? 可能有一点点,但证据很薄弱。
- 它危险吗? 研究人员警告说,我们需要保持谨慎。如果我们不经过充分测试就推出这些工具,它们可能会在无意中扩大健康差距(例如,如果 AI 只对那些精通科技的人有效)。
总结
把公共卫生领域的 AI 想象成汽车里一个未经测试的新引擎。我们知道它可能会让车跑得更快,但目前这个引擎还在喷火、燃油表是坏的,而且我们还没有在足够的道路上驾驶过它,无法确定它是否可靠。
研究人员正在呼吁更好的地图和更好的测试。他们希望未来的研究能更清晰地说明 AI 的运作方式,包含更多样化的人群,并使用更好的方法来衡量人们是否真的活动得更多了。在此之前,我们不应假设仅仅因为一个应用是“AI 驱动”的,它就会自动让我们变得更强壮。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。