← 最新论文
💻 computer science

An Effective and Cost-Efficient Agentic Framework for Ethereum Smart Contract Auditing

本文介绍了 Heimdallr,这是一个用于以太坊智能合约审计的高性价比智能体框架,它通过利用函数级代码重组、启发式推理和级联验证,利用轻量级开源模型实现了高精度的漏洞检测与攻击链构建,在速度、成本和准确性方面显著优于现有工具,并成功识别了现实世界的攻击和零日漏洞。

原作者: Xiaohui Hu, Wun Yu Chan, Yuejie Shi, Qumeng Sun, Wei-Cheng Wang, Chiachih Wu, Haoyu Wang, Ningyu He

发布于 2026-01-27
📖 1 分钟阅读☕ 轻松阅读

原作者: Xiaohui Hu, Wun Yu Chan, Yuejie Shi, Qumeng Sun, Wei-Cheng Wang, Chiachih Wu, Haoyu Wang, Ningyu He

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

以下是对论文《一种高效且具成本效益的以太坊智能合约审计智能体框架》(Heimdallr)的解释,已翻译为中文。

问题所在:“不可扩展、多噪音且昂贵”的保安

想象一下,智能合约就像是数字银行的自动化规则。如果代码中存在漏洞,黑客就能窃取数百万美元。目前,检查这些规则简直是一场噩梦:

  1. 人工审计(人类专家): 这就像雇佣一支精英侦探团队去阅读图书馆里的每一页书。它极其彻底,但成本高昂(数万美元)且耗时数周。小型项目根本负担不起。
  2. 静态分析器(金属探测器): 这些是用于扫描代码中已知“错误形状”的自动化工具。问题在于,它们就像一个会对所有东西——硬币、钥匙甚至易拉罐——都发出鸣响的金属探测器。它们会产生大量的误报(假阳性),导致人类审计师应接不暇并最终选择忽略它们。
  3. 早期 AI 审计师(幻觉不断的实习生): 为了加速进度,人们引入了使用 AI(大语言模型)的新工具。但它们就像一个过度自信的实习生,经常凭空捏造事实。它们经常发明并不存在的漏洞(幻觉),或者因为无法理解银行规则的完整逻辑而错过复杂的诡计。此外,运行它们的成本也非常高。

解决方案:Heimdallr(带着清单的“超级实习生”)

作者构建了 Heimdallr,这是一个全新的自动化系统,旨在成为安全领域的“金发姑娘原则”(既不过度昂贵,也不过于嘈杂,而且真正聪明)。他们称其为“智能体框架(Agentic Framework)”,这是一种高级说法,意指它是一个不仅会猜测,还会进行计划、检查和验证的 AI 智能体。

可以将 Heimdallr 想象成一个三阶段的安全流程

第一阶段:组织者(上下文剖析)

问题: 想象一下试图一次性阅读一部 1000 页的小说。你会迷失方向。同样地,如果一次性喂给 AI 过多的代码,AI 模型也会感到困惑。
Heimdallr 的妙招: Heimdallr 不会一次性读完整本书,而是像图书管理员一样将故事分为逻辑清晰的章节。它观察代码的不同部分是如何相互通信的(例如谁调用了谁),并将它们打包成逻辑连贯且易于处理的“块”。这确保了 AI 不会遗漏代码中两个遥远部分之间的联系。

第二阶段:侦探(模型无关的审计)

问题: 标准的 AI 可能只会说:“这看起来很可疑。”但它真的是犯罪吗?
Heimdallr 的妙招: Heimdallr 使用了**“计划-提醒-解决”**策略:

  • 计划: 它查看代码块并询问:“黑客可能在哪里发动袭击?”
  • 提醒: 在进行猜测之前,它会提取一份“小抄”(知识库),其中包含真实的过往黑客攻击案例和近期新闻。它提醒 AI:“嘿,还记得去年这种特定类型的银行是如何被抢劫的吗?检查一下这里是否看起来像那样。”
  • 解决: 它不仅仅是猜测。它运行三种不同类型的测试:
    1. “如果……会怎样”测试: 它想象一个拥有无限资金或控制天气(区块链时间)的黑客,观察系统在极端压力下是否会崩溃。
    2. 数学测试: 它使用严格的数学计算器(Z3 求解器)来检查数字是否计算正确,因为 AI 擅长逻辑但不擅长数学。
    3. 连锁反应测试: 它检查一个房间里的小漏洞是否会引发连锁反应,从而导致整个建筑爆炸。

第三阶段:过滤器(假阳性过滤)

问题: 即使是优秀的侦探也可能会误判无辜的人。
Heimdlyrr 的妙招: 这是最关键的部分。在向人类展示结果之前,Heimdallr 会进行第二次更严格的检查。它会问:“这真的是一个真实的威胁,还是我们只是凭空想象出来的?”它过滤掉了噪音,确保当它说“发现了一个漏洞”时,这个漏洞几乎可以确定是真的。

结果:为什么这很重要

论文声称 Heimdallr 是一个巨大的飞跃:

  • 它是侦探,而不是猜测机器: 在对 20 起近期真实发生的黑客攻击(发生在 2025 年 6 月之后)进行测试时,Heimdallr 成功破解了其中的 17 起,并准确解释了黑客是如何实施攻击的。它还在实时系统中发现了 4 个全新的(零日)漏洞,这些漏洞本可以挽救 4 亿美元
  • 它很便宜: 虽然其他工具扫描一个项目可能需要 15 到 50 美元,但 Heimdallr 的成本可以低至 0.22 美元(使用较小的开源 AI 模型)或 2.31 美元(使用最强大的模型)。
  • 它很快: 它可以几分钟内扫描完一个项目,而旧工具则需要数小时。
  • 它击败了竞争对手: 在与其它顶级工具的正面交锋中,Heimdallr 发现的真实漏洞更多,报告的假漏洞更少。在与 548 名人类审计师的竞赛中,自动化的 Heimdallr 排名在前 4%

局限性(不足之处)

作者坦诚地说明了 Heimdallr 目前还不能做的事情:

  • 语言: 它目前只能说“Solidity”(以太坊的语言)。它目前还无法阅读其他区块链编写的代码。
  • 长期诡计: 它非常擅长捕捉即时的攻击,但可能会错过那些需要数周时间才能展开的缓慢、长期的攻击(例如慢性中毒)。
  • 安全性: 由于它寻找漏洞的能力如此之强,作者决定不免费发布代码。他们不想让黑客利用它来寻找银行的漏洞。相反,他们提供一种安全的服务,供经过审核的专业人士使用。

总结

Heimdallr 就像是一个超智能、高性价比的保安,它能够组织代码、研究过去的犯罪案例、进行严格的数学测试,并在拉响警报前反复检查自己的工作。它解决了旧有的“昂贵但缓慢”与“廉价但满口谎言”之间的矛盾,提供了一个快速、便宜且真正可靠的解决方案。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →