← 最新论文
🤖 machine learning

Sovereign Execution Brokers: Enforcing Certificate-Bound Authority in Agentic Control Planes

本文介绍了主权执行代理(Sovereign Execution Broker, SEB),这是一种运行时强制执行边界,通过将动作提议与执行解耦来保障智能体基础设施的安全,确保所有生产环境的变更在由短寿命、可审计的身份执行之前,都经过针对认证权威、策略约束以及实时状态条件的严格验证。

原作者: Jun He, Deying Yu

发布于 2026-06-19
📖 1 分钟阅读☕ 轻松阅读

原作者: Jun He, Deying Yu

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一下,你有一个非常聪明但有点难以捉摸的机器人助手。这个机器人很擅长规划事情,比如“让我们为访客开一扇新门”或者“让我们关掉空房间里的灯”。然而,由于机器人的思维方式是非线性的、具有创造性的,它偶尔可能会出现“故障”,或者被一个糟糕的提示词(prompt)误导,从而产生“炸掉整栋建筑”或“删除数据库”的想法。

在过去,为了让这个机器人能够工作,我们必须给它一把万能钥匙(永久凭证),它可以打开大楼里的任何一扇门。这是很危险的:如果机器人出了故障,它可以使用这把万能钥匙来摧毁一切。

这篇论文介绍了一种新的安全系统,叫做主权执行代理(Sovereign Execution Broker,简称 SEB)。你可以把 SEB 想象成不是一个持钥匙人,而是一个严格的高科技保安,站在机器人与大楼门扉之间。

以下是该系统的工作原理,使用了简单的类比:

1. 三步走流程

与其让机器人持有钥匙,不如将过程分为三个不同的角色:

  • 规划者(机器人): 机器人提出一个想法(例如,“打开前门”)。它没有任何钥匙。它只是提出了一个提议。
  • 裁判(主权保障边界): 一个受信任的人类或 AI 系统会对提议进行审查。如果这个想法是安全的且符合规则,裁判就会发放一张特殊的、一次性的门票(加密证书)。这张门票会说明:“是的,这项特定的操作是被允许的,但仅限于这扇特定的门,且仅限现在。”
  • 保安(SEB): 这是故事中的新英雄。机器人带着门票去找保安。保安并不信任机器人。保安会非常仔细地检查门票:
    • 门票是真的吗?(是由裁判签署的吗?)
    • 这是对应正确门的门票吗?(请求是否与计划相符?)
    • 门票过期了吗?(是否经过了太长时间?)
    • 大楼发生变化了吗?(在我们等待时,是否有人把那扇门锁上了?)
    • 规则手册改变了吗?(是否刚刚出台了新的安全策略?)

2. “一次性”的魔力

如果保安满意了,他们不会把钥匙交给机器人。相反,保安会暂时解锁那扇门,仅持续一秒钟,让机器人推开门,然后立即重新上锁。

  • 没有万能钥匙: 机器人永远不会持有永久性的钥匙。它无法绕过保安,也无法在之后使用这把钥匙。
  • 作用域限制: 如果门票写着“打开前门”,保安会确保机器人无法打开后门,即使它试图欺骗系统。
  • 即时撤销: 如果发生安全警报(比如火灾),裁判可以立即使所有门票失效。即使机器人的口袋里揣着门票,保安也会看到警报并说:“抱歉,这张门票现在是废纸了,”然后拒绝开门。

3. 为什么这比旧系统更好

  • 旧方式(IAM): “这是万能钥匙。你可以做任何事。”如果机器人被黑客攻击,黑客就会得到万能钥匙。
  • 折中方式(审计日志): “随你去做,但我们稍后会记录下你的行为。”这就像是一个只在抢劫发生之后才进行记录的安全摄像头。它无法阻止犯罪。
  • SEB 方式: “除非你有一张新鲜的、经过验证的门票,并且我在行动的那一瞬间进行检查,否则你碰都别想碰这扇门,而且我会为你开门正好一秒钟。”这在犯罪发生之前就将其阻止。

4. 这篇论文实际测试了什么

作者使用真实的云技术(如 Amazon AWS 和 Kubernetes)构建了一个运行中的“保安”系统原型。他们测试了以下内容:

  • 速度: 机器人必须等待多久?(答案是:它增加了一个微小的延迟,简单任务约为 28 毫秒,复杂任务约为 136 毫秒,对于计算机来说这非常快)。
  • 安全性: 如果他们尝试用假门票、过期的门票,或者尝试打开错误的门来欺骗系统,保安会阻止吗?(答案是:是的,100% 成功拦截)。
  • 韧性: 如果保安失去了互联网连接会发生什么?(答案是:它会默认进入“安全模式”,并在能够再次验证规则之前拒绝打开任何门)。

总结

**主权执行代理(SEB)**是一个安全层,它确保即使 AI 智能体处于困惑、被黑客攻击或表现出恶意行为的状态,只要它没有获得由受信任保安在行动时刻实时验证的、新鲜的一次性许可凭证,它就无法对计算机系统造成破坏。它将“信任机器人”转变为“验证行为”。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →