← 最新论文
💻 computer science

Towards Cybersecurity SuperIntelligence (CSI): What's the best harness for cybersecurity?

本文介绍了网络安全超级智能(CSI),这是一种通过共享黑板统一异构大语言模型驱动代理框架的元脚手架架构,其证明结合结构多样的脚手架比任何单一脚手架能实现显著更高的网络安全挑战覆盖率(57.6%)和效率。

原作者: Víctor Mayoral-Vilches, Francesco Balassone, María Sanz-Gómez, Paul Zabalegui Landa, Daniel Sánchez Prieto, Marina Oteiza Álvarez, Davide Quarta, Martin Pinzger

发布于 2026-05-28
📖 1 分钟阅读☕ 轻松阅读

原作者: Víctor Mayoral-Vilches, Francesco Balassone, María Sanz-Gómez, Paul Zabalegui Landa, Daniel Sánchez Prieto, Marina Oteiza Álvarez, Davide Quarta, Martin Pinzger

原始论文根据 CC0 1.0(http://creativecommons.org/publicdomain/zero/1.0/)发布到公有领域。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一下,你正在尝试解决一个庞大而复杂的谜题(一项网络安全挑战)。你有一位非常聪明的助手(一个 AI 模型)可以协助你,但你向它发出指令的方式与其智能程度同样重要。

这篇论文提出了一个简单的问题:“ harness”或引导该 AI 解决网络安全问题的最佳方式是什么?

研究人员发现,并不存在一种“完美”的指令方式。相反,成功的关键在于使用一个由不同指令风格组成的团队协同工作。

以下是他们研究发现的简要说明,辅以简单的类比:

1. 问题所在:一种方案无法适用于所有情况

将 AI 模型想象成一位才华横溢的侦探。然而,你可以以五种不同的“制服”或“风格”(称为支架)雇佣这位侦探:

  • 风格 A(CSI::Claude): 这位侦探会与你交谈、提出问题,并逐一尝试各种工具。
  • 风格 B(CSI::Codex): 这位侦探会编写代码来自动解决问题。
  • 风格 C(CSI::GCAI): 这是一位极简主义的侦探,言简意赅,直奔主题。
  • 风格 D(CSI::CAI): 这是一位严格的侦探,遵循一套非常严格且有限的规则。
  • 风格 E(CSI::Mistral): 这位侦探以单次 bursts 的方式工作,而非进行漫长的对话。

研究人员在 33 个不同的网络安全谜题上测试了所有五种风格。他们发现,没有任何一种风格在所有方面都是最佳的

  • 有时风格 A 解决了风格 B 无法解决的谜题。
  • 有时风格 C 解决了风格 A 遗漏的谜题。
  • 有时风格 D 找到了其他人未能发现的解决方案。

这就像一支运动队:你不会想要一支由五名守门员组成的队伍。你需要一名守门员、一名前锋和一名后卫。每个人都有独特的优势。

2. “联合”结果:将他们置于同一房间

首先,研究人员尝试按顺序运行这五种风格(或者仅挑选其中最佳的一种)。

  • 表现最佳的单一风格解决了约 45% 的谜题。
  • 如果将前四种主要风格的结果结合起来(暂时忽略第五种),他们解决了 51.5% 的谜题。

这证明了这些风格是互补的。它们在不同方面会失败。如果你拥有一个由不同风格组成的团队,其覆盖范围将超过任何单一专家独自所能达到的范围。

3. “黑板”突破:真正的魔法

研究人员并未止步于组建一个团队;他们构建了一个系统,让团队能够实时相互沟通

他们创建了一个**“黑板”**(一个共享的数字白板)。

  • 工作原理: 所有不同的 AI 风格同时运行。在工作过程中,他们将各自的发现、线索和部分解决方案写入这个共享黑板。
  • 魔法所在: 如果“风格 A"陷入困境,它可以查看黑板,发现“风格 B"刚刚找到了一个有助于它的线索。如果“风格 C"找到了拼图的一小块,“风格 D"可以利用这一小块来完成工作。

结果:

  • 通过让它们共享信息,他们解决了 57.6% 的谜题。
  • 这比最佳单一风格独自工作提高了 27%
  • 他们完成得更快(20.2 小时对比 26.8 小时),且成本相近

4. 主要结论

该论文的结论是,网络安全 AI 的“最佳 harness"并非试图构建一个完美、超级聪明的单一 AI 代理。

相反,最佳方法是构建一个多样化的团队,由不同的代理组成,它们都使用相同的基础大脑(同一个 AI 模型),但具有不同的“个性”或工作方式。当你让它们共享一块“黑板”以交换想法时,它们所展现出的智慧将远超其各部分之和。

简而言之: 不要寻找那一个完美的工具。要打造一个包含不同工具的工具箱,让它们协同工作,观察它们如何解决任何单一工具都无法独自解决的问题。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →