AiWebArmor: A Robust, Precise AI-based Framework for Web Application Firewalls
AiWebArmor 是一种新颖的高吞吐量 AI 框架,它结合了基于 ModernBERT 的语义分析与通过可解释树提升分类器实现的统计特征,在生产级 Web 环境中实现了 99.92% 的多类威胁检测准确率和 0.01% 的误报率,且延迟低于一毫秒。
原始论文采用 CC BY 4.0 许可(https://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
数字世界运行在 Web 应用程序之上,这些是驱动从在线银行到社交媒体等一切事物的无形引擎。为了确保这些系统的安全,组织依赖于被称为 Web 应用防火墙(WAF)的数字守门人。可以将这些防火墙想象成繁忙建筑入口处的保安;他们的职责是检查每一个试图进入的人,在放行之前检查是否携带武器或危险物品。多年来,这些保安一直依赖一种简单的方法:他们检查一份已知的不良行为清单。如果访客符合清单上的描述,他们就会被拦截;如果不匹配,则会被放行。这种方法在应对已知威胁时效果良好,但在攻击者使用新花招或伪装其行为时却显得力不从心。此外,这种僵化的检查往往会将无辜的访客误认为罪犯,从而引发误报,拦截合法流量并让用户感到沮丧。安全专家的挑战在于,如何构建一个足够聪明、能够理解访客行为的上下文(而不仅仅是其外观)的守门人,同时又要足够快,能够处理每秒数百万人的访问而不减慢建筑的运转速度。
在一项新的研究中,来自伊朗科技大学的研究人员 Farid Mousavi 和 Arash AbdiHejrandoost 开发了一种他们称之为 AiWebArmor 的解决方案。该系统旨在成为更智能、更快、更精确的传统 Web 安全守门人。AiWebArmor 不再仅仅依赖静态的已知模式列表,而是利用先进的人工智能来阅读并理解 Web 请求的实际内容,就像人类阅读句子以理解其含义一样。研究人员构建这个系统是为了应对现代互联网混乱且复杂的现实情况,即攻击在不断演变,且流量来自无数不同的来源。他们的目标是创建一个能够以近乎完美的准确度区分无害用户与复杂攻击者的工具,同时在处理请求时能在眨眼之间完成。
AiWebArmor 的核心是一个结合了深度理解与快速、实用检查的两部分策略。首先,系统使用一种复杂的语言模型(一种在海量文本上训练过的 AI 类型)来分析传入 Web 请求的语义含义。这使得系统能够领会信息背后的意图,即使攻击者试图通过重新排列单词或使用奇怪字符来隐藏其真实目的。然而,仅依靠语言理解可能会很慢,有时也会错过攻击中微妙的结构性线索。为了解决这个问题,研究人员将语言模型与一组三十个特定的、手工设计的统计检查相结合。这些检查观察请求的物理属性,例如消息的长度、特定符号的频率以及字符模式的复杂度。通过将语言模型的深度理解与统计检查提供的快速、具体的数据一起输入到一个强大的决策引擎中,该系统为它看到的每一个请求构建了一幅完整的图像。
为了确保这一新系统在现实世界中有效,研究人员并没有仅仅在小规模、干净的练习数据集上进行测试。他们构建了一个包含超过 270 万条记录的庞大测试场。这个数据集是知名学术基准与从实际运行中的 Web 服务器收集的原始、非结构化流量的独特结合。这种方法使他们能够针对互联网流量的混乱和多样性对系统进行测试,而不仅仅是教科书中那些整齐、有序的例子。他们还解决了人工智能中的一个常见问题,即系统可能会学会忽略那些虽然罕见但极其危险的攻击,因为这些攻击出现的频率低于正常流量。他们使用了一种特殊的训练技术,强制系统对这些稀有的危险模式给予同等的关注,从而确保不会忽视它们。
广泛测试的结果令人瞩目。在处理这个庞大的混合数据集时,AiWebArmor 实现了 99.92% 的准确率,能够以极高的精度正确识别威胁和安全流量。或许更令人印象深刻的是它避免误报的能力。传统系统经常拦截无辜用户,但 AiWebArmor 将误报率降低到了前所未有的 0.01%。这意味着在每 10,000 个合法请求中,系统只会错误地拦截一个。在与包括使用复杂神经网络的深度学习模型在内的其他先进方法进行直接对比时,AiWebArmor 始终表现更优,尤其是在减少这些代价高昂的误报方面,其优势达到了一百到一千倍。
速度是另一个关键因素,因为安全系统绝不能拖慢其保护的网站。研究人员测量了系统处理请求所需的时间,发现它能够维持每请求不到三毫秒的速度。这足以直接部署在现代 Web 服务器的高速层中,而不会给用户带来任何明显的延迟。该系统已成功集成到实时的 NGINX 服务器环境中,证明了它不仅是一个理论概念,而且是一个可以投入实战的实用工具。研究人员还展示了系统可以将复杂的决策转化为人类安全操作员可以阅读和验证的简单、易懂的规则,从而弥合了先进人工智能与人类监督之间的鸿沟。
研究结论指出,通过将深度的语义理解与细粒度的统计分析相结合,构建一个既高度准确又极其快速的 Web 防火墙是可能的。AiWebArmor 代表了 Web 安全领域的一次重大进步,超越了静态列表和僵化规则的局限性。它提供了一种保护数字基础设施免受各种威胁(从常见的注入攻击到复杂的混淆尝试)的方法,同时不会牺牲现代用户所期望的速度或可靠性。尽管研究人员指出没有任何系统是完美的,且未来的工作将侧重于实时适应新的、未知的攻击,但他们目前的工作为下一代 Web 防御提供了坚实且精确的基础。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。