← 最新论文
💻 computer science

Competing Visions of Ethical AI: A Case Study of OpenAI

这项关于 OpenAI 的案例研究表明,尽管该组织的公开论述极力强调安全与风险,但却显著避免了将学术与倡议层面的伦理框架纳入其中,这引发了人们对潜在“伦理洗白”行为的担忧,并凸显了改进治理机制的必要性。

原作者: Melissa Wilfley, Mengting Ai, Madelyn Rose Sanfilippo

发布于 2026-07-21
📖 1 分钟阅读☕ 轻松阅读

原作者: Melissa Wilfley, Mengting Ai, Madelyn Rose Sanfilippo

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一下,人工智能(AI)的世界就像一个巨大且繁忙的建筑工地。这里正在建造的机器功能极其强大,能够写故事、解决复杂的数学问题,甚至创作艺术。但由于这些机器还如此之新且发展极快,建造它们的人仍在摸索规则手册。在这个领域,存在着一场关于如何确保这些智能机器是“好”的辩论。有些人谈论“伦理”(ethics),这就像是一个道德指南针——一套关于对错、公平和正义的深刻问题。另一些人则谈论“安全”(safety),这更像是安全帽和安全带——防止机器失控或伤害他人的实际步骤。虽然大家都同意我们需要两者,但问题在于:究竟是谁在谈论什么,以及他们是否真的在遵循自己设定的规则?

这篇论文深入研究了 AI 世界中最大的建筑团队之一——一家名为 OpenAI 的公司。研究人员想要观察这家公司如何随着时间的推移来谈论这些宏大的概念。他们不仅仅是在听这家公司说了什么;他们扮演了数字侦探的角色,扫描了数以千计的文件、博客文章和研究论文,精确统计了该公司使用“伦理”、“安全”、“风险”和“对齐”等词汇的频率。他们将这家公司的公开声音视为一座巨大的图书馆,通过检查书架来查看哪些书被阅读得最多,而哪些书正落满灰尘。

数据讲述的故事有些令人惊讶。当研究人员查看 OpenAI 的公开网站——即他们与普通大众交流的地方时,他们发现“伦理”这个词几乎是隐形的。它出现在不到 4% 的文章中。这就像走进一间房子,主人一直在谈论“防火安全”和“紧急出口”,却从未提到过“火”这个词本身,尽管他们才是那个拿着火柴的人。事实上,“安全”一词在短短一年内出现了近 700 次,而“伦理”仅出现了 7 次。

OpenAI 的公开信息并没有使用深奥的哲学语言,而是由“安全”、“风险”和“对齐”等技术术语所主导。研究人员发现,当该公司确实使用“伦理”这个词时,它通常只是一个快速的提及,比如标题中的一个注脚或段落中的一句话,而不是一次严肃的讨论。这仿佛他们是在把这个词当作墙上的装饰,而不是建筑的工具。有趣的是,研究人员注意到该公司的标签和分类正在发生变化。有时一篇文章被标记为“伦理与安全”,但其中的文本几乎完全没有提到伦理。这表明,这些标签的变化可能是为了向公众传递不同的信号,而不是反映公司在思考道德问题时发生了深刻的变化。

然而,当研究人员查看该公司的学术论文——即那些为其他科学家编写的严肃技术文档时,情况略有不同。在这里,“伦理”出现的频率更高,出现在约 17% 的论文中。但即便是在这些严肃的文档中,这个词也经常出现在边缘位置、脚注中或简短的价值观列表中,而不是作为研究的核心焦点。研究人员认为,虽然该公司非常擅长谈论技术安全和管理风险,但它倾向于将关于“伦理”的沉重道德对话放在一旁,将其视为一种声誉勋章,而非构建机器的严格规则手册。

简而言之,这篇论文表明,OpenAI 为谈论“安全”和“风险”建立了一个非常响亮的扩音器,但在谈论“伦理”时却保持了非常安静的声音。他们并不是在忽视“行善”的概念,而是以一种侧重于技术修复和规避危险的方式来界定它,而不是关注公平和正义等更深层的问题。研究人员得出结论,这种表达方式可能会让公司看起来负责任,但也意味着关于 AI 在“对”与“错”方面究竟是什么的那些艰难且复杂的问题,正被推向背景,隐藏在技术安全话术的围墙之后。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →