← 最新论文
🤖 AI

When Ads Become Profiles: Uncovering the Invisible Risk of Web Advertising at Scale with LLMs

本文表明,现成的多模态大语言模型能够仅通过被动接收的 Facebook 广告曝光,高效且准确地逆向推导用户的敏感属性(如政治倾向和就业状态),揭示了一个关键性的系统性漏洞,即广告流成为了高保真的数字足迹,绕过了当前平台的防护机制。

原作者: Baiyu Chen, Benjamin Tag, Hao Xue, Daniel Angus, Flora Salim

发布于 2026-01-30
📖 1 分钟阅读☕ 轻松阅读

原作者: Baiyu Chen, Benjamin Tag, Hao Xue, Daniel Angus, Flora Salim

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

核心理念:你的广告是一本秘密日记

想象一下你走进一家杂货店。店长手里有一份关于你个人习惯的秘密清单:你知道你买婴儿奶粉,你喜欢吃辣,还支持某个特定的政党。他们并没有递给你一张尿布传单,而是递给了你热辣酱和当地政客竞选活动的传单。

这篇论文指出,你在 Facebook 上看到的广告流就像那份秘密清单。 尽管公司声称不会根据敏感信息(如政治立场或健康状况)向你展示广告,但他们的计算机算法仍会自动这样做,以吸引你点击。

可怕之处在于?你不再需要成为黑客才能破解你的秘密。你只需要一个强大的 AI(大语言模型,简称 LLM)来阅读你所看到的广告,并写出你的个人画像。

新型威胁:“神奇侦探”

过去,如果有人想从你的广告中猜出你的秘密,他们需要成为一名超级数据科学家。他们必须构建一个复杂的机器人,喂给它数百万个案例,并进行数月的训练。这既困难、昂贵又缓慢。

论文指出,这种情况已经改变了。
现在,我们拥有“现成”的 AI 模型(比如那些你可以免费在线聊天的 AI)。它们就像是**“神奇侦探”**。它们非常聪明,你不需要对它们进行训练。你只需把你看过的广告列表展示给它们,它们就能瞬间说出:“哦,这个人很可能是一名大学毕业生,从事医疗行业,并且支持 X 党。”

攻击是如何运作的(“浏览器扩展程序”的小伎俩)

研究人员设想了一个场景:某个恶意行为者想要窃取你的个人画像。他们不需要黑入你的电脑或安装病毒。

  • 类比: 想象一个看起来很友好的“优惠券查找器”或“广告拦截器”浏览器扩展程序。你安装它是为了省钱或停止烦人的弹窗。
  • 伎俩: 这个扩展程序有一个合法的理由去查看你访问的网页(为了寻找优惠券)。研究人员展示了,同一个扩展程序可以悄悄地复制你看到的每一条广告。
  • 结果: 它将这些广告发送给“神奇侦探”AI。AI 阅读这些广告,并构建出关于你私生活的详细画像(你的工作、受教育程度、政治观点),而你对此完全不知情。

研究人员实际做了什么

为了证明这是可能的,研究人员并没有攻击真实的人。他们使用了来自**澳大利亚广告观察站(Australian Ad Observatory)**的大规模真实数据集。

  • 数据: 他们查看了在两年内向 891 名真实用户展示的超过 43.5 万条广告
  • 测试: 他们将这些广告输入到强大的 AI 模型(如 Gemini 和 GPT-4/5)中,并要求 AI 猜测用户的秘密(年龄、性别、收入、受教育程度、职业和政党)。
  • 对比: 他们将 AI 的猜测结果与以下内容进行了比较:
    1. 随机猜测: 仅仅是随机挑选答案。
    2. 人口普查数据: 根据澳大利亚的“常见情况”进行猜测(例如,因为大多数人都就业,所以猜测每个人都有工作)。
    3. 人类专家: 真实的人在看到同样的广告时尝试进行猜测。

令人震惊的结果

论文发现,AI 在这方面表现得极其出色,甚至经常胜过专家。

  1. AI 对比人类: 对于像受教育程度职业这样复杂的属性,AI 实际上比人类专家更擅长。对于性别,AI 与人类的表现不相上下。
  2. 速度与成本: AI 完成这项任务的速度比人类快 52 倍,成本比人类低 223 倍
  3. 短时间窗口: 你不需要观察某人多年。AI 仅通过观察你在单次短暂浏览会话(如 10–15 分钟)中看到的广告,就能准确猜测你的秘密。
  4. “接近正确”依然危险: 即使 AI 无法猜中你的精确年龄(例如“34 岁”),它通常也非常接近(例如“30–39 岁”)。论文称之为“方向性正确性”。这就像是在猜一个人是“中年人”而不是精确的“42 岁”。这仍然是一个巨大的隐私泄露。

总结

论文得出结论,广告是高保真的数字足迹。

即使社交媒体平台移除了用于保护隐私的“敏感”定向按钮,AI 算法仍然会根据你的私人特征对广告进行分类。由于强大的 AI 现在既免费又易于使用,任何人都可以将这些广告转化为关于你生活的详细画像。

主要启示: 你很难轻易退出广告展示。而现在,仅仅通过观看这些广告,你的私生活就会被比人类更聪明、更快速的机器解码。这是一个全新的、隐形的风险,目前的隐私法律可能尚未做好应对准备。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →