← 最新论文
🤖 machine learning

CHASM: Unveiling Covert Advertisements on Chinese Social Media

本文介绍了 CHASM,这是一个包含近 5000 条来自中文社交媒体平台小红书的真实世界隐蔽广告的新颖数据集,旨在揭示当前多模态大语言模型在检测此类欺骗性帖子方面的不足,并强调亟需改进针对这一新兴威胁的微调与防御机制。

原作者: Jingyi Zheng, Tianyi Hu, Yule Liu, Zhen Sun, Zongmin Zhang, Zifan Peng, Wenhan Dong, Xinlei He

发布于 2026-04-23
📖 1 分钟阅读☕ 轻松阅读

原作者: Jingyi Zheng, Tianyi Hu, Yule Liu, Zhen Sun, Zongmin Zhang, Zifan Peng, Wenhan Dong, Xinlei He

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

以下是关于"CHASM"研究的简明德语解释,辅以生动的图像和比喻。

🕵️‍♀️ 盛大的伪装:当广告伪装成朋友

想象一下,你正在参加一场派对(即社交媒体)。突然,有人走到你面前,假装是你的老朋友。他向你讲述一个关于他新鞋的有趣故事,并说:“哦,这双鞋超级舒服!”你心想:“太棒了,谢谢你的推荐!”

但随后你意识到:这家伙根本不是朋友。 他是一名推销员,想在你未察觉其已获付费的情况下向你推销这双鞋。他 simply 混入了人群之中。

这正是研究人员通过CHASM所研究的问题。在中国社交媒体平台(如“小红书”,类似于 Instagram 或 TikTok)上,这类隐蔽广告越来越多。他们称之为“隐蔽广告”(Covert Advertisement)。

🧩 问题所在:为何计算机无法察觉

迄今为止,人工智能模型(计算机的“大脑”)学会识别的是显而易见的广告。那就像一块写着“广告”的标牌。但这种隐蔽广告却像一套伪装服

  • 普通广告:“立即购买这款肥皂!五折优惠!”(一块巨大、发光的霓虹灯招牌)。
  • 隐蔽广告:“我的一天压力很大,但这块肥皂让我的皮肤平静下来。我爱死它了!”(看起来像普通帖子,实则是精心策划的)。

研究人员发现,当前最先进、最聪明的人工智能(如 GPT-4o 或 Gemini)在面对这种伪装时完全失效。它们会被欺骗,就像人类也可能被欺骗一样。它们常常认为这是普通帖子,或者在每一个普通帖子中都看到广告。

🛠️ 解决方案:新的训练课程(CHASM)

为了让人工智能更出色,研究人员构建了新工具:CHASM

将 CHASM 想象成一个间谍训练场

  1. 数据:他们从平台上收集了近 5000 条真实帖子。
  2. 伪装:其中包含许多看起来确实像普通建议、实则是隐蔽广告的帖子;以及许多看起来像广告、实则只是真实建议的帖子。
  3. 匿名化:如同间谍佩戴面具,他们将所有图片中的姓名和面部进行了模糊处理,以确保不侵犯任何人的隐私。

🏋️‍♂️ 训练:从新手到专家

研究人员在各种人工智能模型上测试了这个训练场:

  • 无训练(零样本):人工智能模型直接进入,从未见过此类内容。结果:灾难性的。它们几乎无法发现隐蔽广告。这就像给一个新手看一部间谍电影,却指望他立刻理解隐藏的密码。
  • 有训练(微调):随后,研究人员用 CHASM 对人工智能进行了“训练”。他们向它们展示:“看,这里评论区有一个隐藏链接”或者“这里只赞美了一个品牌,这很可疑。”
    • 结果:人工智能显著变强了!其中一款人工智能(Qwen2.5)在训练后几乎能达到经验丰富的真人审核员的水准。它们学会了关注那些揭露欺诈的小细节。

🔍 我们学到了什么?(错误分析)

即使经过训练,人工智能仍会犯错。研究人员发现了问题所在:

  1. 隐蔽的线索:购买链接通常不在正文中,而是藏在评论区或图片里。人工智能经常忽略这些微小线索。
  2. 结构:真正的广告通常只聚焦于一个产品。而真实用户通常会谈论多件事。人工智能尚未完美掌握这种“节奏”。
  3. 语言:隐蔽广告常使用夸张的词汇(“史上最佳!”),而真实用户有时会说:“还行,但不完美。”

🚀 结论:为何这很重要?

这项研究是对平台和人工智能开发者的警钟

  • 对我们用户而言:它表明我们必须保持警惕。并非每个向我们推荐产品的“朋友”都是真正的朋友。
  • 对平台而言:它们必须使用像 CHASM 这样的特殊数据来训练其人工智能系统,以揭露这些欺诈者。
  • 对未来而言:这是一场竞赛。广告主在伪装方面会变得越来越聪明,而人工智能也必须同样聪明,才能识破它们。

简而言之:CHASM 是教导人工智能在社交媒体上识别“披着羊皮的狼”、防止其掏空我们钱包的第一步。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →