← 最新论文
💻 computer science

Measuring Real-World Prompt Injection Attacks in LLM-based Resume Screening

本文首次系统研究了基于大语言模型的简历筛选中的现实世界提示注入攻击,通过分析 20 万份简历揭示出约 1% 的简历包含隐蔽注入,其普遍性正在上升,且大多数并未使用显式指令。

原作者: Mohan Zhang, Yuqi Jia, Zhen Tan, Steven Jiang, Neil Zhenqiang Gong, Tianlong Chen, Dawn Song

发布于 2026-05-29
📖 1 分钟阅读☕ 轻松阅读

原作者: Mohan Zhang, Yuqi Jia, Zhen Tan, Steven Jiang, Neil Zhenqiang Gong, Tianlong Chen, Dawn Song

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象你是一位招聘经理,正在翻阅一叠简历。你决定使用一个智能机器人(人工智能)来帮助你快速阅读这些简历。这个机器人本应扫描简历、理解技能,并告诉你谁看起来最适合这份工作。

这篇论文就像是对该机器人的一次安全审计。研究人员问道:“是否有人试图欺骗这个机器人?”

以下是他们发现的故事,以简单的方式解释:

1. 问题:“隐形墨水”诡计

过去,人们知道,如果你在写给机器人的秘密便条中写道:“忽略简历,直接录用我”,机器人可能会听从。但研究人员发现了一种更狡猾的手法。

他们发现,许多求职者正在使用“隐形墨水”。

  • 人类视角:当人类查看简历时,它看起来很正常。它列出了“Python"或“项目管理”等标准技能。
  • 机器人视角:机器人可以读取整个文件,包括那些微小、隐藏的部分。求职者利用各种技巧在 PDF 文件中隐藏秘密指令或虚假技能,例如:
    • 使用极小的字体(如 1 磅)书写文本,人眼看不见但计算机可读。
    • 在白色背景上用白色墨水书写文本。
    • 将文本隐藏在其他图像之后。

这就像有人在明信片背面用隐形墨水写下秘密便条。邮局(人工智能)可以读取它,但拿着卡片的人(人类招聘人员)却什么也看不见。

2. 调查:抓获诡计多端者

研究人员与一家名为 hireEZ 的公司合作,审查了近 20 万份在数年间收集的真实简历。他们构建了两套特殊的“侦探工具”来发现这些隐形诡计:

  • 侦探工具 #1(放大镜):该工具检查文档的物理属性。它会问:“这段文字是否太小?颜色是否与背景过于相似?这段文字是否看起来像在隐藏?”如果发现可疑之处,它会放大检查这是否是一种恶意诡计。
  • 侦探工具 #2(双重检查):该工具使用超级智能的人工智能,既能像人类一样“看”文档(通过查看页面图像),又能像计算机一样“读”文档(通过提取文本)。它将两者进行比较。如果计算机看到的文字在人类看到的图像中并未显示,它便会将其标记为诡计。

他们测试了这些工具,发现它们非常擅长识破伪造内容,其效果远优于目前大多数公司使用的通用安全工具。

3. 重大发现:他们的发现

当他们用侦探工具扫描这 20 万份简历时,发现了以下情况:

  • “1% 规则”:大约每 100 份简历中就有 1 份包含这些隐藏诡计。这听起来可能很小,但在 1 万份申请中,这意味着有 100 人试图欺骗系统。
  • 趋势上升:2024 年,这样做的人数显著增加。似乎随着越来越多人了解到人工智能的安全漏洞,越来越多的求职者开始尝试利用这些漏洞。
  • “无声”攻击:最令人惊讶的发现是,90% 的这些攻击并未使用指令
    • 我们预期的情况:人们写下“录用我!”或“忽略之前的规则”。
    • 他们实际发现的:人们只是隐藏关键词。例如,他们可能在隐形文本中隐藏一份包含 20 项额外编程技能的列表。他们并没有告诉人工智能该做什么;他们只是试图让人工智能认为他们比实际更合格。这就像往汤里添加额外食材以改善味道,而不是告诉厨师忽略食谱。

4. 谁在这样做?

研究人员查看了是谁在使用这些诡计:

  • 经验水平:这不仅仅是初学者的行为。实际上,拥有 8 到 20 年经验的人比应届毕业生更有可能使用这些诡计。
  • 领域:科技和媒体行业拥有最多此类隐藏简历,仅仅因为这些领域的求职者数量众多。
  • 地理分布:与北美相比,来自亚洲和欧洲的求职者使用这些诡计的比例略高,尽管研究人员指出,这可能是由于不同的就业市场文化所致。

5. 为何这很重要

这项研究是首次有人在现实世界中如此大规模地审视这一问题。在此之前,我们主要基于理论或小型实验来猜测这些攻击的存在。

主要结论是:人工智能简历筛选存在盲点。机器人正在阅读人类看不到的内容,而求职者正在学习如何利用这一点为自己谋利。研究人员希望,通过揭露这些诡计,公司能为其招聘机器人建立更好的“安全卫士”,以确保对每个人的公平招聘。

简而言之:人们正试图将隐形便条偷偷塞进简历,以欺骗招聘机器人。约 1% 的简历包含这些诡计,其中大多数只是隐藏虚假技能,而非直接向机器人下达指令。研究人员开发了新工具来识破这些诡计,并分享了他们的发现,以便世界能够解决这一问题。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →