Quality Perceptions and Intended Engagement in Response to AI-Generated and AI-Assisted News
一项在德语区瑞士进行的预注册调查实验显示,尽管读者认为人工智能生成的新闻与人类撰写的新闻在质量上不相上下,但披露人工智能的参与会暂时增加对特定文章的即时参与度,而不会改变阅读人工智能生成新闻的长期意向。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象一下,你正在参加一个品汤派对,桌上有三碗不同的汤。你还不知道是谁做的。你尝了一口,并从三个方面进行了评分:它好喝吗?(可读性)、它看起来像是名厨做的吗?(专业度),以及我能相信这碗汤不会让我生病吗?(可信度)。
这正是这篇论文中的研究人员所做的事情,只不过他们提供的不是汤,而是新闻文章。
以下是他们实验的故事,通过简单的拆解呈现如下:
设置:盲测
研究人员在德语区的瑞士招募了近 600 名参与者。他们给参与者阅读简短的新闻片段。参与者并不知道这些片段出自三位不同的“厨师”之手:
- 人类厨师: 由真正的记者撰写故事。
- 助手厨师: 由记者撰写故事,但由 AI(如 ChatGPT)协助进行了改写。
- 机器人厨师: 由 AI 根据仅有的标题和导语进行创作。
第一轮(盲测):
在参与者知道谁做了汤之前,他们先对文章进行了评分。
- 结果: 评分几乎完全一致。“机器人厨师”做的汤尝起来一样好喝,看起来同样专业,而且看起来也同样值得信赖。
- 启示: 当人们不知道是电脑写了新闻时,他们无法分辨其中的区别。他们认为质量是相同的。
转折:揭开标签
品尝结束后,研究人员揭开了幕布。他们告诉参与者:“顺便说一下,你刚才评价的那碗汤其实是由机器人(或机器人辅助的厨师)制作的。”
然后,他们提出了两个新问题:
- “再吃一口”测试: “在得知这一点后,你是否想继续阅读这篇文章的剩余部分?”
- “未来菜单”测试: “总的来说,你将来是否愿意食用(阅读)机器人制作的新闻?”
结果:好奇心 vs. 习惯
这里变得非常有趣:
“再吃一口”测试(短期):
那些发现自己刚刚阅读的是机器人新闻的人,突然想要阅读更多内容。与那些认为这是人类编写的新闻的人相比,他们的阅读意愿显著上升。类比: 想象一下,你以为你在吃一个真人制作的蛋糕,但随后发现它其实是一个 3D 打印机制作的高度逼真的蛋糕。你可能会感到非常好奇,“等等,这是机器做的?让我看看剩下的部分!”以至于你想继续吃下去。并不是因为你更喜欢这个蛋糕,而是因为这种惊喜感激发了你的好奇心。
“未来菜单”测试(长期):
当被问及将来是否会普遍选择阅读机器人新闻时,答案是没有变化。那些阅读了机器人新闻的群体并没有突然决定:“我现在爱上 AI 新闻了!”他们依然和阅读人类新闻的人一样持有怀疑态度。类比: 即使你对那个 3D 打印的蛋糕产生了一时的好奇,你仍然更倾向于去普通的面包店买你的日常面包。这种惊喜并没有改变你的长期习惯。
这意味着什么(用通俗易懂的话说)
该论文得出了两个主要结论:
- 质量是盲目的: 如果去掉标签,AI 新闻看起来和感觉起来都与人类新闻一样好。读者并不会自动假设 AI 写的东西很“差”;他们是对页面上的文字进行公正的评判。
- 披露是火星,而非火焰: 告诉人们“这是由 AI 制作的”并不会让他们立即讨厌它,也不会让他们爱上它。相反,它像是一个火星,创造了一个好奇心的瞬间。人们想要凑近观察,看看是否能发现机器人的痕迹。但一旦这种好奇心消散,他们对 AI 新闻深层的信任并不会因此提高。
底线是:
读者目前处于一种“好奇且怀疑”的状态。在不知情的情况下,他们无法分辨质量差异;但当他们知情时,他们会产生一点兴趣去仔细观察,但他们仍然还没准备好让 AI 成为他们的主要新闻来源。论文表明,仅仅揭示“这是 AI”并不能建立信任;它只是让人停下来观察一下。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。