You See It, They Don't: An Exploratory Study of User-to-User Variation in Instagram Comments
这项探索性研究表明,Instagram 新推出的基于人工智能的评论排序系统使新闻帖子的可见评论比非新闻帖子呈现更少的差异,且这种差异更多由帖子指标驱动,而非由性别、政治倾向或地理位置等用户属性驱动。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象 Instagram 是一个庞大而熙熙攘攘的城镇广场。多年来,站在广场上的每个人都看到同一块公告板:帖子顶部的评论对所有人来说都是一样的,就像一份固定的、最响亮声音的清单。
但在 2025 年 3 月,镇长(Meta)安装了一位新的、看不见的 AI 图书管理员。这位管理员不再向你展示相同的清单;而是根据你是谁,为你策划一份“个性化”的顶部评论清单。人们的担忧是:“如果这位图书管理员向保守派人士展示一套评论,而向自由派人士展示完全不同的另一套,我们是否会停止彼此倾听,转而生活在各自分离的现实之中?”
这篇论文是一项小规模实验,旨在验证这位管理员是否真的在这样做。
实验:四位“幽灵”购物者
为了测试这一点,研究人员创建了四个“傀儡”账号(扮演真实人物的虚假用户资料)。他们赋予这些幽灵特定的个性:
- 一位女性民主党人
- 一位女性共和党人
- 一位男性民主党人
- 一位男性共和党人
他们还利用名为 VPN 的数字隧道,将这些幽灵发送到两个不同的“地点”(纽约和德克萨斯州),以观察地理位置是否会影响他们看到的内容。
随后,他们让这些幽灵浏览 200 篇不同的帖子:100 篇来自新闻账号(如 CNN 或福克斯新闻),100 篇来自有趣的非新闻账号(如猫爱好者或体育迷)。他们问道:“当这四个不同的幽灵查看同一篇帖子时,他们看到的顶部评论是否不同?”
令人惊讶的结果
研究人员原本预计幽灵们会看到截然不同的清单,尤其是在新闻帖子上。他们以为 AI 会积极地筛选评论,以匹配用户的政治观点。
相反,他们发现了完全相反的情况:
- “幽灵”效应很小: 平均而言,这四个不同的幽灵在 88% 的情况下看到了相同的顶部评论。只有约**12%**的评论会根据观看者的不同而发生变化。
- 新闻比娱乐更稳定: 令人惊讶的是,新闻帖子上的评论比娱乐帖子(如猫或美食)上的评论更不容易发生变化。AI 似乎对新闻展示的是更一致的清单,而对娱乐内容则不然。
- 你是谁不如帖子本身重要: 研究人员原本认为用户的性别或政治倾向是造成差异的主要原因。他们错了。最大的因素实际上是帖子的受欢迎程度(账号拥有多少粉丝)以及它已经有多少条评论。
- 类比: 想象一家受欢迎的餐厅。无论你是素食者还是肉食者,如果餐厅挤满了人,且每个人都在点同一道菜,那么服务员向你展示的菜单看起来就会是一样的。“人群”(评论数量)比你的个人口味更重要。
- 列表未变,顺序变了: 虽然评论的列表大多相同,但它们出现的顺序却大不相同。
- 类比: 想象一个播放列表。每个人听到的可能都是同样的 10 首歌,但对于民主党人,第一首歌是抒情慢歌;而对于共和党人,第一首歌则是摇滚颂歌。内容都在,但侧重点发生了偏移。
这意味着什么(以及不意味着什么)
该论文得出结论,虽然 AI 确实在个性化评论的顺序,但它尚未对不同用户彻底隐藏整条评论。至少在目前的特定设置下,顶部评论的“过滤气泡”效应比预期的要弱。
然而,作者谨慎地表示,这仅仅是“初步观察”。
- “新手”问题: 这些虚假账号是新的。AI 可能尚未充分了解它们,因此展示的是“默认”清单。随着账号变老且 AI 了解更多关于它们的信息,差异可能会扩大。
- “回声室”现实: 研究人员注意到,在新闻帖子上,顶部评论通常本来就与新闻来源一致(例如,在右翼新闻网站上出现右翼评论)。因此,即使没有 AI,评论本身也已经极化。AI 只是继续向所有人展示相同的“已达成共识”的评论。
核心结论
将这项研究比作检查新房子中的恒温器。研究人员想知道恒温器是否对某些人设定为“冷冻”,而对另一些人设定为“加热”。他们发现,目前对大多数人的温度基本相同(仅 12% 的差异),但风扇速度(评论的顺序)确实不同。
该论文并未声称这是最终答案,也未断言该系统完美无缺。它只是说:“我们检查过了,个性化目前尚未达到我们担心的极端程度,但我们需要持续观察,因为该系统仍在不断学习。”
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。