想象一下互联网是一个巨大且繁忙的集市。多年来,店主们(广告商)一直能够跟随购物者(用户)从一家店走到另一家店,并详细记录下他们看过的所有东西,即使他们最后并没有购买。这被称为“追踪”,也是大多数在线广告运作的方式。
2019年,这个最大商场的所有者——谷歌,决定这种做法有点过于侵入性了。他们启动了一个名为“隐私沙盒”(Privacy Sandbox)的大规模建设工程。他们的目标是建立一套新的规则和工具,让店主们仍能有效地销售商品,而不需要随身携带一本永久性的跟踪笔记。
这篇论文就像是一个长期的纪录片摄制组,观察了这个建筑工地七年之久,从第一张蓝图到2025年底该项目正式取消为止。以下是他们的发现,用通俗易懂的方式进行了解释:
1. 新工具构成的“鬼城”
谷歌建造了超过25种新工具(API)来取代旧的追踪方法。其中一些工具像是“兴趣组”(根据人们的喜好将人归类),另一些则是“分区 Cookie”(为每个店主提供一份仅在特定商店内有效的私人笔记)。
研究发现: 尽管这些工具已经存在多年,但实际上很少有店主使用它们。
- 类比: 想象一下,谷歌建造了一套全新的、高科技的高速公路系统来取代旧的土路。但当他们打开大门时,几乎没有人在这条路上行驶。旧的土路(第三方 Cookie)仍然是大家走的主要路径。
- 结果: 只有极少数特定的工具看到了真正的流量,即便如此,使用情况也非常不均衡。大多数新工具都处于闲置状态,落满了灰尘。
2. “观望”的人群
研究人员观察了究竟是谁在尝试使用这些新工具。
- 研究发现: 这并不是一场新公司的涌入浪潮。主要还是那些在初期(大约2023年)就开始测试工具的少数几家大玩家。
- 类比: 这就像是一家新餐厅开业。通常你会迎来一波新顾客。但在这里,唯一的食客是那三位从第一天起就在品尝食物的老顾客。当店主(谷歌)开始说,“也许我们不会关闭旧厨房了”时,这些老顾客就停止了尝试新菜单,转而回到了他们钟爱的旧菜肴。
- 停滞: 采用率在2024年底达到顶峰,然后陷入停滞。一旦谷歌宣布他们将推迟禁止旧的追踪方法,所有人就停止了尝试新工具。
3. “漏洞”问题
其中一个被称为 UA Client Hints 的工具,本应帮助网站在不泄露用户身份的情况下,了解用户使用的是什么样的手机或电脑。
- 研究发现: 许多追踪者并没有谨慎使用它,而是利用这个工具来构建用户的“指纹”,而这恰恰是隐私沙盒想要阻止的行为。
- 类比: 这就像城市建造了一个安全的闸门来防止人们潜入。但追踪者们找到了利用闸门上的名牌来记录每个人车牌号的方法。他们利用这个新工具,用旧的、隐蔽的追踪方式进行了追踪。
4. “选择加入”与“选择退出”的分歧
论文强调了谷歌的浏览器(Chrome)与其他浏览器(如 Safari、Firefox 和 Brave)之间的重大差异。
- 研究发现: 当谷歌花费多年时间试图让每个人都同意一种追踪是“选择加入”(即你必须说“是”)的新系统时,其他浏览器则直接默认关闭了追踪(即“选择退出”)。
- 类比: 谷歌试图组织一场镇民大会,投票决定是否停止让陌生人跟随你。与此同时,其他社区已经自动锁上了自家的大门。到谷歌的会议在2025年结束时,其他社区早已安全多年了。
5. 为什么失败了?
论文指出,隐私沙盒未能如期开展的原因有以下几点:
- 不确定性: 规则一直在变。谷歌不断推迟禁止旧追踪方法的日期。如果拆迁队一直说“也许我们不会拆除它了”,你还会去盖一座新房子吗?
- 成本: 使用这些新工具既困难又昂贵,而且需要大量的时间。
- 缺乏信任: 研究界和其他浏览器制造商经常对这些新工具是否真的具备隐私性持怀疑态度。
总结
隐私沙盒是一次宏大的、初衷良好的实验,但最终并未按计划运作。它表明了:
- 变革是艰难的: 让整个互联网生态系统转向一个全新的、复杂的系统是非常困难的。
- 激励机制至关重要: 如果“旧方式”没有被严格禁止,公司就不会费力去切换到“新方式”。
- 隐私并不统一: 当谷歌还在研究如何让用户“选择”是否保持隐私时,其他浏览器已经决定为所有人“强制”执行隐私保护。
论文得出结论,要让下一代互联网隐私工具发挥作用,它们需要更简单、清晰有用,并且最重要的是,它们需要被设置为“默认开启”,而不是等待每个人都同意一个复杂的计划。
技术摘要:隐私沙盒 Web API 采用与弃用过程中的教训
问题陈述
尽管 Web 参与者多年来一直致力于减少追踪,但在实现用户隐私与 Web 效用之间的平衡方面仍不明确。2019 年,Google 推出了**隐私沙盒(Privacy Sandbox)**计划,旨在利用新的隐私保护 API 来取代第三方 Cookie(TPC)和指纹识别技术,以满足广告、转化测量和欺诈检测等用例。然而,在 2025 年 10 月,Google 宣布取消该项目,弃用大部分新引入的 API,并继续在 Chrome 中支持 TPC。
本文探讨了对于这些变化,Web 生态系统反应缺乏全面理解的问题。具体而言,本文旨在通过对这些技术整个生命周期(部分长达 5 年以上)的采用与最终弃用过程进行表征,以了解该计划为何失败,并为未来的 Web 隐私提案总结教训。
研究方法
作者进行了一项纵向测量与分析研究,覆盖范围从 2020 年 1 月到 2026 年 4 月。他们利用三个主要数据源,分析了前 10 万个网站(按 CrUX 排名)中 13 个核心隐私沙盒 API 的流行程度,以及 Chrome 用户的实际体验情况:
- Chrome 遥测数据(Chrome Telemetry): 来自 Chrome 用户(跨所有平台和渠道)的聚合数据,追踪特定 Blink 特性(隐私沙盒 API)被检测到的每日页面加载百分比。该数据集涵盖了该计划的完整可用期。
- HTTP Archive (HA):
- HA-blink: 对前 10 万个网站进行每月爬取,以检测隐私沙盒特性的存在,从而作为热门网站采用情况的代理指标。
- HA-requests: 对检测到特性的根页面中的 HTTP 请求头和响应体(脚本/HTML)进行针对性的语法分析。这使得作者能够识别特定的采用者(主机)、实现方法(JS 与 HTTP 请求头)以及使用模式。
- 开源仓库: 利用 Chromium 源码树和 Google 相关网站集(RWS)仓库的版本控制数据,追踪证明注册(attestation enrollments)和 RWS 列表编辑情况。
本研究重点关注 13 个核心 API:归因报告(Attribution Reporting)、CHIPS、FedCM、FLoC、围栏框架(Fenced Frames)、隐私聚合(Private Aggregation)、私有状态令牌(Private State Tokens)、受保护的受众(Protected Audience)、RWS、共享存储(Shared Storage)、存储访问(Storage Access)、主题(Topics)以及 UA 客户端提示(UA Client Hints)。
核心贡献
- 纵向范围: 这是同类研究中规模最大的研究,分析了所有隐私沙盒特性在其整个生命周期内(5 年以上)在 10 万个顶级网站及真实用户浏览旅程中的采用与使用情况。
- 采用特征化: 本文识别了谁采用了这些 API、使用了哪些 API 以及它们是如何实现的,并在该计划的时间线、激励机制和风险背景下对这些发现进行了阐释。
- 隐私违规检测: 研究强调了特定的隐私问题,包括在用户同意之前进行的 API 调用、UA 客户端提示的持续使用削弱了用户代理(UA)精简工作,以及利用这些提示进行浏览器指纹识别的滥用行为。
- 可操作的建议: 作者为下一代 Web 隐私提案提供了具体的建议,重点关注设计、激励措施和默认保护。
- 可复现性: 测量方法和相关产物均已开源,以鼓励进一步探索。
关键结果
1. 采用情况不均衡且有限 (RQ1)
- 高度差异化的使用: 采用情况极其不均衡。只有五个 API(UA 客户端提示、CHIPS、归因报告、主题和共享存储)出现在超过 11.7% 的页面加载中。其余 API 的使用量微乎其微或几乎没有。
- 停滞现象: 在 2023 年引入 API 后,采用率有所上升,但在 2024 年第三季度达到顶峰并趋于停滞。这种停滞与 Google 推迟并最终取消 TPC 弃用计划的时间点相吻合。使用率在这一时期之后从未恢复,并随着弃用公告的发布而开始下降。
- 早期采用者主导: 大多数采用者从该计划初期就已活跃。顶层采用者的集合多年来保持一致,这表明早期测试者驱动了大部分的使用量。
2. 采用者画像与实现方式 (RQ2)
- 证明程序(Attestation): 仅有 295 个唯一实体参与了针对五个特定 API(归因报告、隐私聚合、受保护的受众、共享存储和主题)所需的证明注册过程。其中大多数是广告商或与在线服务(分析、托管、新闻)相关的实体。
- RWS: 仅有 73 组相关网站集(Related Website Sets)获得批准,仅占声明的跨站关系的极小部分。
- 实现一致性: 前 10 名 API 采用者(主机)在 2023、2024 和 2025 年间保持一致,表明一小群大型 Web 参与者驱动了生态系统的参与。
3. 受支持 API 的状态 (RQ3)
- 大多数 API 使用率极低: 在 Chrome 中仍受支持的六个 API(CHIPS、FedCM、围栏框架、私有状态令牌、存储访问和 UA 客户端提示)中,除 UA 客户端提示外,其余所有 API 的使用率都非常低(≤5.2% 的页面加载)。
- CHIPS 的具体情况: 虽然 CHIPS 出现在约 34.5% 的页面加载中,但它仅占平均第三方 Cookie 的约 6.7%。其采用是由少数大型参与者(如 Criteo、Rubicon Project)驱动的,这些参与者具有广泛的 Web 覆盖范围。
- UA 客户端提示的滥用: UA 客户端提示是使用最广泛的 API,出现在超过 62% 的页面加载中。作者发现,该 API 主要被追踪和广告实体(Google、Meta、Microsoft)用于获取高熵的用户代理特征。这实际上恢复了对浏览器此前已限制的指纹识别向量的访问,削弱了 UA 精简工作的成果。
重要性与主张
本文认为,隐私沙盒实验说明了“在浏览器中修复”方案的局限性以及不同浏览器厂商之间的差异。虽然 Google 的计划在 Chrome 中实现了很大程度上为可选的限制,但其他浏览器(Brave、Firefox、Safari)则通过默认启用更强的隐私保护来实现目标。
作者声称,该计划的失败是由以下因素共同驱动的:
- 激励机制: 参与者的动力主要来自于 TPC 弃用的威胁。一旦该威胁被移除,兴趣便迅速下降。
- 风险与不确定性: 不断演变的提案性质、不明确的隐私-效用权衡以及潜在的法律风险阻碍了更广泛的采用。
- 缺乏展示价值: 提案的价值未能预先得到展示,从而无法获得生态系统的长期承诺。
研究结论指出,未来的隐私提案必须清晰地阐明用例,在设计上具备不可被滥用的特性,并将用户同意和法律影响视为 API 设计中不可或缺的一部分。此外,研究强调,如果没有外部激励或监管压力,生态系统不太可能自愿采用新的隐私机制,尤其是考虑到隐私沙盒被弃用的先例。
每周获取最佳 computer science 论文。
受到斯坦福、剑桥和法国科学院研究人员的信赖。
请查收邮箱确认订阅。
出了点问题,再试一次?
无垃圾邮件,随时退订。