The Acknowledgment Point Is the System: Durable Policy-Decision Receipts for AI Audit Evidence
本文介绍了 RuntimeGuard-AI,这是一个研究原型,它通过在显式的同步边界将策略决策与签名收据进行绑定,从而确保持久且可验证的 AI 审计证据,进而提供了一种在低延迟缓冲性能与高完整性同步记录之间经过权衡的方案,而非一种“免费”的异步解决方案。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
在人工智能的世界里,系统会在瞬间做出决策,通常只需眨眼之间。但为了让该决策值得信赖,必须有一个永久的记录,一个即使在断电或计算机崩溃时也不会被抹除的记录。这就是问责制的内核挑战:确切知道数字承诺何时变成了事实。如果一台计算机告诉用户,“我已经保存了刚才所做行为的证明”,但保存过程仍在后台进行,那么这个承诺就是脆弱的。突发的崩溃可能会在记录真正安全之前就抹掉内存。相反,如果计算机等待记录绝对安全后才开口,用户可能会感受到明显的延迟。研究人员面临的问题不仅是如何编写日志,而是如何确切地知道该日志何时变得不可更改且可以被信任。
一组独立的研究人员构建了一个新系统来解决这一特定的计时问题,开发出了一个将“确认时刻”视为“真相时刻”的原型系统。他们的工作——被称为 RuntimeGuard-AI——专注于一个简单但困难的规则:计算机在证据尚未实际在潜在崩溃中幸存之前,绝不应告诉用户证据已经存在。为了实现这一目标,他们剥离了以往版本系统中依赖的复杂证明层,从底层开始重建引擎,使其更小、更快且更易于测试。其结果是一个将每一项决策都与特定策略绑定,向存储写入一条微小的安全记录,并向用户交付一份明确说明该记录是处于安全状态还是仍处于脆弱状态的签名收据的系统。
研究人员设计该系统提供三种不同的处理方式,让用户在速度与安全之间进行选择。在最快模式下,系统将记录写入临时缓冲区,并立即返回一份承认数据尚未安全的收件。这适用于对极小数据丢失风险可以接受的高速操作。在另外两种模式下,系统会进行等待。它强制计算机在返回保证记录具有持久性的收据之前,物理同步数据到存储驱动器,前提是操作系统和存储硬件遵循其文档说明的语义。其中一种模式确保数据在磁盘上是安全的,而另一种模式则确保数据已刷新到存储控制器,尽管系统明确声明不具备针对远程复制或回滚的免疫力。研究人员发现,这种选择并非没有代价。当他们在配备四个工作线程的现代计算机处理器上使用标准大小的提示词测试该系统时,快速缓冲模式每秒可处理约 27,193 个请求,延迟仅为 141.9 微秒。然而,当他们切换到保证数据在磁盘上安全的模式时,速度急剧下降至每秒约 242 个请求,延迟上升至 16.0 毫秒。这种差距并非漏洞;它是存储工作原理的一种实测现实。该系统证明了你无法同时拥有即时确认和保证持久性。
除了速度测试外,研究人员还构建了一种方法来验证这些记录是否随时间推移被篡改过。他们将数千份此类签名收据组合成更大的数据包,称为“纪元”(epochs)。每个纪元都用加密签名进行封存,创建了一条审计员可以检查的证据链。如果有人试图篡改过去的决策或删除记录,证据链就会断裂,签名也将不再匹配,尽管系统指出,拥有重写完整记录能力的特权操作员仍可能绕过这些校验和。系统还包含一个严格的恢复过程。如果计算机崩溃并重启,引擎会自动检查它找到的记录,确保它们完整且顺序正确。它会拒绝任何部分或损坏的数据,在确定历史记录完整之前拒绝启动。在测试中,恢复并验证一个包含 100,000 条记录的日志耗时不到一秒,这表明系统可以在重启后快速恢复,而不会对其发生过的事情感到混乱。
研究人员非常谨慎地定义了其系统的职责范围。它并不证明人工智能模型本身的思考是否正确,也不证明运行决策的代码是否没有隐藏病毒。它无法阻止一个已经控制了整个计算机的黑客重写历史。相反,它在特定决策与特定策略之间建立了一种紧密的联系,确保如果决策被记录,它就是完全按照策略执行的,尽管它无法保护免受实现本身被替换的影响。该系统就像是一个人工智能行为的精确会计师,精确测量着安全所带来的毫秒级和每秒请求数成本。它提供了一个清晰、诚实的接口,在真正完成保存时说“我已经保存了此项”,或者在仍在等待时说“我尚未保存”。通过将记录的持久性变为对话中可见的一部分,该系统将模糊的安全承诺转变为一种可测量的、机器可检查的事实。
最终呈现出的景象是清晰而非魔幻。该系统并不提供那种记录既即时又永久的“免费午餐”。它迫使人们做出选择,并以精准度衡量这种选择的价格。研究人员发现,将一大批 100,000 条记录密封进单个签名纪元大约需要 97 毫秒,这对于创建一个长期的、可验证的历史来说是一个很小的代价。这项工作表明,人工智能真正的问责制需要接受这些延迟和成本,而不是希望通过巧妙的技巧来规避它们。该系统作为一个实用的工具,适用于任何需要确切知道某个数字决策已按其发生方式被完整保存,并随时准备接受审计师或法庭审查的人。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。