Cognitive Digital Twins: Ethical Risks and Governance for AI Systems That Model the Mind
本文将认知数字孪生(CDTs)定义为人类认知的动态计算表示,提出了一个用于应对其独特的伦理风险(如误导性表征和代理权力不对称)的 5A 治理框架,并主张建立新的监管要求,以治理对思维本身而非仅仅是对数据处理或自动化决策的表征。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象一下你拥有一个数字影子。这不仅仅是一张你的照片或一份你最喜欢的电影清单。它是一个活生生的、呼吸着的计算机程序,了解你的思维方式、你的恐惧、你如何做决策,甚至了解如果有人对你言语刻薄时你会如何反应。
这篇论文将其称为认知数字孪生(Cognitive Digital Twin, CDT)。
把它想象成一个完全由你的现实生活数据构建的电子游戏角色。但这个角色不仅仅是在游戏世界中奔跑,它还被用来预测你会做什么,甚至在现实世界中代表你进行行动。
以下是利用日常比喻对论文内容的简单拆解。
1. 什么是认知数字孪生?
我们熟知的多数 AI 工具都像是个人助手。它们帮助你找餐厅或写邮件。它们并不真正了解你,只是了解你的喜好。
认知数字孪生则不同。它是你大脑的模拟系统。
- “患者”案例: 想象一位医生使用一个名为迪亚戈(Diego)的患者的计算机模型。在医生改变迪亚戈的药物之前,他们先在计算机模型上进行模拟。他们询问:“如果我们给迪亚戈这种新药,他会感觉好些,还是会变得抑郁?”计算机基于迪亚戈大脑的数字副本给出了答案。
- “员工”案例: 想象一位名叫玛雅(Maya)的设计师。她有一个 AI 双生体,能阅读她的邮件并了解她的写作风格。这个双生体开始替她回复邮件和安排会议。同事们对待这个双生体,就如同对待玛雅本人。
论文指出,这些系统正在变得真实。它们不再仅仅是工具,而是正在成为我们内在自我的表征,可以被机构(如医院、公司或政府)所信任并使用。
2. 5A 框架:如何衡量危险程度
作者创建了一个名为 5A 框架 的清单,用以理解这些双生体有多强大(以及多危险)。把它想象成一场针对 AI 的驾驶执照测试:
- 权威性 (Authority) ——(钥匙): 这个双生体只能建议事情,还是可以做事情?
- 低权威: 它建议你看一部电影。
- 高权威: 它签署合同、花你的钱,或者告诉你的老板你病了。
- 自主性 (Autonomy) ——(方向盘): 这个双生体是等待你告诉它做什么,还是它自己在驾驶?
- 低自主: 它等待指令。
- 高自主: 它发现问题,决定解决问题,并在不询问你的情况下采取行动。
- 访问与控制 (Access and Control) ——(遥控器): 谁握着遥控器?
- 你能看到你的双生体知道什么吗?你能删除它吗?你能阻止它向保险公司分享你的秘密吗?论文指出,你应该持有这个“遥控器”,而不是构建该双生体的公司。
- 问责制 (Accountability) ——(责任归属): 如果双生体犯了错,谁来承担责任?
- 如果玛雅的双生体承诺了一个她无法达到的期限,是玛雅的错?还是公司的错?论文指出,我们需要明确的规则,以免人们因为自己并未实际控制的事情而受到责难。
- 可用性 (Availability) ——(门票): 谁有权使用这些强大的双生体?
- 如果只有富人拥有辅助工作的“超级大脑”,而穷人却没有,这就会造成不公平。此外,如果一家公司为每位员工都配备了一个可以代表其进行谈判的双生体,那么这家公司可能会变得过于强大。
3. 隐藏的危险(“可能会出什么错”)
论文列举了几种具体的风险,我们可以将其想象为矩阵中的故障(Glitches in the Matrix):
- “错误的地图”(误表征): 双生体可能认为它了解你,但实际上它是错的。如果计算机认为你很懒,仅仅因为你错过了一次预约(而实际上你当时生病了),它可能会开始把你当作一个懒惰的人对待。这个系统创造了一个“自我实现的预言”,让你开始表现得像计算机认为的那样。
- “机器中的幽灵”(影子双生体): 这是最可怕的部分。想象一家公司利用你的公开数据、工作邮件和手机使用情况构建了一个你的双生体,但你对此完全不知情。他们利用这个“影子双生体”来猜测如何操纵你,或者决定是否给你晋升。你根本不知道这个关于你思维的数字副本的存在。
- “测试假人”(缺乏参与的模拟): 在医院的例子中,医生首先在计算机双生体上测试疗法。但如果双生体是错误的呢?医生可能会根据一个糟糕的模拟结果来改变真实患者的治疗方案。患者在从未被征求意见的情况下,变成了实验对象。
- “伪装的你”(代理行动): 如果你的双生体发送了一封邮件说“我同意这项交易”,而你其实并没有阅读它,这真的算作你的协议吗?论文警告说,高质量的双生体可能会误导人们,让他们认为机器人的话语就是自己的思想。
4. 为什么现有的规则不起作用
我们已经有了关于隐私的法律(如 GDPR)和关于自动化决策的规则。论文指出,这些对于认知数字孪生来说远远不够。
- 差距: 现行法律关注的是数据(你的姓名、地址)和决策(计算机是否拒绝了你的贷款?)。
- 问题: 认知数字孪生处于两者之间。它们关乎你的思维是如何被表征的。即使最终决策尚未做出,仅仅是计算机通过“思考”你并模拟你的反应这一行为本身,就可能改变医生、老板或保险公司对待你的方式。
5. 我们该怎么做?(解决方案)
论文提出了专门针对这些“思维模型”的新规则:
- 分层知情同意: 你不应该只是点击一次“我同意”。你应该能够表达:“是的,可以使用我的数据来帮我记录事情,但不要使用它来预测我是否会被解雇。”
- 标签真实性: 如果一封邮件是由双生体撰写的,它必须注明:“此内容由 AI 起草。”如果医生根据模拟结果改变了治疗方案,他们必须记录他们使用了模拟技术。
- “关机开关”: 你必须拥有删除你的双生体或停止其被使用的权利,即使公司声称这是“为了你好”。
- 禁止影子双生体: 如果一个组织在未经你知情的情况下构建了你的思维模型,你应该被告知。
核心结论
论文认为,认知数字孪生是一种新型技术。它们不仅仅是工具;它们是我们心灵的数字版本。
如果我们不仔细监管它们,我们可能会面临这样一个世界:
- 我们的数字影子比我们自己更了解我们。
- 公司和政府利用这些影子来操纵我们,或在未经我们许可的情况下就我们做出决策。
- 我们失去了对自身身份的控制,因为一个计算机程序正在代表我们“行动”。
目标不是禁止这些技术,而是确保我们始终是自己心灵的主人,而不是那些模拟我们心灵的计算机。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。