SEED: Semi-supervised Continual MalwarE Detection for Tackling ConcEpt Drift on a BuDget
本文提出了SEED,这是一种半监督持续学习框架,它结合了定制的二元交叉熵目标、主动学习和奇异值分解,以在概念漂移且标注数据有限的情况下有效检测恶意软件,并在具有弱语义结构的数据集上显著优于现有的层次对比学习方法。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象你是一名繁忙机场的安保人员。你的工作是在成千上万无辜的旅客(良性应用)中识别出坏蛋(恶意软件)。
问题所在:“变色龙”罪犯
麻烦在于,坏蛋们不断变换伪装。一个月前,一个罪犯可能戴着红帽子;今天,他们换上了蓝帽子。在计算机领域,这被称为概念漂移。如果你的安全系统仅针对“红帽子”进行训练,那么当后来出现“蓝帽子”时,它将会漏掉它们。
为了跟上步伐,你需要每个月重新训练安全系统。但这里有个陷阱:标注既昂贵又缓慢。 为了教会系统识别“坏蛋”的模样,人类专家必须手动检查并标注样本。你无法负担雇佣足够多的专家来标注每一个旅客。你只有极小的预算来标注少数样本。
旧方法:“配对”陷阱
以前的方法试图通过一种称为对比学习的技术来解决这个问题。想象这是一场“找双胞胎”的游戏。系统试图将长相相似的人归为一组。
- 缺陷: 如果你拥有一本所有人都被正确标注的相册,这个游戏效果极佳。但如果你只有几张已标注的照片(预算有限),系统就会感到困惑。它试图在陌生人中寻找双胞胎,结果要么将无辜者与罪犯归为一组,要么反之。论文表明,当你尝试在标签有限的情况下使用这种“配对”方法时,安全系统的性能会显著下降。
新方案:SEED(智能媒人)
作者提出了一种名为SEED的新方法。将 SEED 想象成不是一个“找双胞胎”的游戏,而是一个利用“记忆库”的智能媒人。
SEED 的工作原理分为三个简单步骤:
1. “记忆库”(缓冲区)
SEED 在一个特殊的记忆库中保存一小部分经过精心挑选的过去样本(包括好的和坏的)。它不是随机存储它们,而是利用一种称为SVD(奇异值分解)的数学技巧对它们进行组织。
- 类比: 想象记忆库是一座图书馆。图书管理员(SVD)不是保留每一本书,而是创建了一份最重要故事的“摘要地图”。这张地图紧凑,却捕捉到了过去发生的一切的精髓。这有助于 SEED 记住过去,而不会被过多数据压垮。
2. “媒人”(针对已见任务)
当一个新的、未标注的旅客到来时,SEED 不会猜测。相反,它将此人投射到记忆库的“摘要地图”上。
- 类比: 它问道:“在我们的历史中,这个人最像谁?”它在过去中找到最接近的匹配项。如果新来的人与上个月的一个已知罪犯非常相似,SEED 也会将其视为罪犯。如果他们看起来像已知的无辜者,就将其视为无辜者。
- 优势: 这使得系统能够通过将未标注的多数群体与已标注的少数群体联系起来进行学习,而无需强迫它们进入僵化的“双胞胎”配对。
3. “不确定性检测器”(针对未见任务)
有时,会出现一种完全新型的罪犯,他们看起来与记忆库中的任何人都截然不同。
- 类比: SEED 计算它对这个人感到多么“困惑”。如果此人与记忆库中的每个人都相距甚远(高不确定性),SEED 就会发出警报。
- 行动: 它对人类专家说:“我不确定这个人。请检查一下,告诉我他们是好是坏。”这确保了人类只将有限的预算花在那些真正需要帮助的样本上。
4. “冷却期”(延迟缓冲区更新)
安全领域最大的风险之一是噪声标签。有时,即使是专家也会犯错,或者自动工具会给出错误的标签。如果你立即将错误的标签放入记忆库,系统就会学到错误的教训,并将该错误传播到未来的任务中。
- 类比: SEED 引入了一个“冷却期”。当收到新标签时,它不会直接进入记忆库。它会等待几个月(延迟)。
- 为什么? 通过等待,系统为标签的验证或“真相”的稳定争取了时间。如果标签是个错误,它可能在被存储之前就被纠正了。这防止了系统用坏数据“污染”自己的记忆。
结果:为何重要
论文在来自 Android 和 Windows 系统的真实世界数据上测试了 SEED。
- 胜利: 与旧的“配对”方法相比,SEED 在捕捉新的、未见过的罪犯方面表现更好,尤其是在人类专家只能标注少量数据(20%)的情况下。
- 改进: 在一个数据集上,当标签稀缺时,SEED 的检测率比旧方法提高了40%。在另一个数据集上,提高了14%。
- 鲁棒性: 即使标签充满错误(噪声),SEED 的“冷却期”策略也能保持系统稳定,而其他方法则崩溃了。
总结
SEED 是一种更聪明的训练安保人员的方法。它不强迫他们死记硬背每一张脸(这太昂贵了),而是帮助他们将新面孔与过去紧凑、有条理的记忆联系起来。它知道何时寻求帮助,并在更新记忆之前等待确保帮助是准确的。这使得安全系统保持敏锐,即使罪犯不断变换伪装。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。