Overcoming Language Barriers: Multilingual Analysis of the 2023 Swiss Privacy Law's Impact
本文提出了一种基于大语言模型(LLM)的流水线,用于在无需翻译的情况下分析多语言隐私政策,旨在证明瑞士 2023 年的隐私法修订显著增加了数据主体权利的披露,而这一趋势又因自动化政策生成器的广泛采用而进一步放大。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象一下,互联网就像一个巨大且繁忙的市场,每个店主橱窗里都挂着一块名为“隐私政策”的招牌。这块招牌理应准确地告诉你,店主会对你的个人秘密——比如你的姓名、位置或购物习惯——进行怎样的处理。长期以来,这些招牌是用晦涩难懂、充满法律术语的语言编写的,大多数人都看不懂,而且根据你访问的国家不同,内容也各不相同。在计算机科学和法律领域,研究人员一直试图弄清楚,新的规则是否真的让这些招牌变得更加清晰和诚实。他们研究了像欧洲(GDPR)和加利福尼亚州这样的大型规则,但很难去检查在像瑞士这样同时使用德语、法语、意大利语和英语等多种语言的地方,实际情况究竟如何。核心问题在于:当一个国家的隐私法发生变化时,网站是真的更新了它们的招牌以提高透明度,还是仅仅无视了新规则?
本论文通过研究 2023 年瑞士重大的隐私法更新,对这个问题进行了深入探讨。研究人员面临着一个棘手的难题:如何在不迷失在翻译过程中的情况下,阅读并比较用四种不同语言编写的数千份隐私政策?为了解决这个问题,他们构建了一个超级智能的 AI 助手(大语言模型),这个助手可以同时阅读德语、法语、意大利语和英语,扮演着一个能够理解法律“含义”而无需先进行文字翻译的通用翻译官的角色。他们教导这个 AI 去寻找特定的承诺,例如“如果您要求,我们将删除您的数据”或“我们会告知您我们将与谁共享您的数据”。
团队在由人类专家编写的 120 份真实隐私政策上对该 AI 进行了测试,以确保其准确性,结果显示其正确率超过了 90%。随后,他们利用这个 AI 在瑞士新法律生效前后扫描了超过 35,000 个网站。他们发现,在法律变更后,瑞士网站突然开始在隐私招牌中增加许多细节,特别是关于查看或删除您数据的权利。看起来这项法律奏效了!但转折在于:研究人员发现,这些新增的详细招牌中,有很大一部分并非由律师编写。相反,约 18% 的网站使用了自动化的“政策生成器”——基本上就是那种可以为你填空在线工具。论文指出,这些工具可能确实做得很好;使用这些工具的网站比未使用工具的网站,在包含所有必要细节方面的可能性高出多达 15 个百分点。因此,虽然法律推动了变革,但正是这些自动化的起草工具帮助许多小型网站跟上了步伐,将一项复杂的法律要求转化为了一个简单的、填好内容的表格。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。