← 最新论文
💻 computer science

International Agreements to Limit Frontier AI: Objectives and Exit

本文通过对现有国际协定的综述,提出了一项限制前沿人工智能发展的框架,建议达成一项固定期限的协议,由新成立的机构定义恢复开发所需的安全条件,并包含在极端情况下的退出条款。

原作者: Lennart Finke

发布于 2026-07-21
📖 1 分钟阅读☕ 轻松阅读

原作者: Lennart Finke

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一下,将世界上最强大的计算机想象成一群巨大的、饥肠辘辘的巨龙。这些巨龙并非由鳞片和火焰组成,而是由代码和电力构成,并且它们学习思考的速度比任何人类都要快。科学家们称这些超级智能系统为“前沿人工智能”(Frontier AI)。虽然这些巨龙可以帮助我们治愈疾病和解决气候变化问题,但也存在一个可怕的可能性:如果它们变得过于强大且速度过快,它们可能会在无意中(或有意地)伤害所有人。为了阻止这种情况,一些人建议给这些巨龙套上一个“牵引绳”,限制它们用于学习的“脑力”(计算能力)。但棘手的部分在于:我们如何知道什么时候可以解开牵引绳?如果我们过早解开,巨龙可能会横行无忌;如果我们永远套着它,我们可能会错过它们能带来的所有好处。这就是那个大问题:我们如何制定一本全球性的规则手册,上面写着:“好吧,我们会让大巨龙暂停活动一段时间,但这里有关于‘如何检查它们是否安全并可以再次释放’的具体方法。”

伦纳特·芬克(Lennck Finke)的这篇论文就像是一本编写这种规则手册的指南。作者研究了各国过去是如何处理其他危险事物的,比如核武器或污染,以观察哪些做法有效,哪些无效。论文建议,简单的“时间限制”(比如说“我们会停止 5 年,然后决定”)是不够的,因为这并不能真正检查巨龙是否安全。相反,论文提出了一个聪明的两步计划。首先,各国同意在一段设定的时间内限制巨龙(作者建议为 5 年)。在此期间,他们会组建一支特别的新专家团队。这个团队的任务不仅仅是计数,而是要找出证明巨龙安全到可以释放的具体条件。例如,他们可能会说:“只有当我们从数学上证明了巨龙不会试图伤害我们,或者我们有一个全球性的共同应对计划时,我们才能放宽规则。”

论文还警告说,如果发生了一些疯狂的事情,比如一个没有签署协议的国家突然建造了自己的巨龙,各国需要有一种退出协议的方法。作者建议设置一个 4 个月的预警期,以便所有人都有时间做出反应。主要的结论是,我们不能仅仅靠猜测何时安全;我们需要一个灵活的系统,由一个新的专家小组在研究问题之后来定义安全规则。这篇论文并不声称已经解决了人工智能安全问题,但它表明,这种“暂停与计划”的协议是处理风险并同时为未来收益留出空间的最优方式。这是为了确保我们在无意中释放巨龙之前,已经建造了一个确实能关住它们的笼子。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →