← Últimos artigos
🤖 machine learning

CHASM: Unveiling Covert Advertisements on Chinese Social Media

Este artigo apresenta o CHASM, um novo conjunto de dados com quase 5.000 anúncios encobertos do mundo real provenientes da plataforma de mídia social chinesa Rednote, para demonstrar que os atuais Modelos de Linguagem Grandes Multimodais têm dificuldade em detectar essas postagens enganosas e para destacar a necessidade de mecanismos aprimorados de ajuste fino e defesa contra essa ameaça emergente.

Autores originais: Jingyi Zheng, Tianyi Hu, Yule Liu, Zhen Sun, Zongmin Zhang, Zifan Peng, Wenhan Dong, Xinlei He

Publicado 2026-04-23
📖 4 min de leitura☕ Leitura rápida

Autores originais: Jingyi Zheng, Tianyi Hu, Yule Liu, Zhen Sun, Zongmin Zhang, Zifan Peng, Wenhan Dong, Xinlei He

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

🕵️‍♀️ A grande disfarce: Quando a publicidade se faz passar por amiga

Imagine que você está em uma festa (a rede social). De repente, alguém se aproxima de você fingindo ser um velho amigo. Ele conta uma história engraçada sobre um novo sapato que está usando e diz: "Ah, este é super confortável!" Você pensa: "Legal, obrigado pela dica!"

Mas então você percebe: Esse cara não é um amigo. Ele é um vendedor que quer lhe vender o sapato, sem que você perceba que ele foi pago. Ele simplesmente se misturou à multidão.

Esse é exatamente o problema que os pesquisadores investigaram com o CHASM. Em plataformas de mídia social chinesas (como a "Rednote", semelhante ao Instagram ou TikTok), há cada vez mais dessa publicidade oculta. Eles chamam isso de "Publicidade Encoberta".

🧩 O problema: Por que os computadores não veem isso

Até agora, os modelos de IA (os "cérebros" dos computadores) aprenderam a reconhecer publicidade óbvia. Isso é como um letreiro com "Publicidade" escrito nele. Mas essa publicidade oculta é como um traje de camuflagem.

  • Publicidade normal: "COMPRE AGORA ESSE SABONETE! 50% DE DESCONTO!" (Um letreiro de neon enorme e brilhante).
  • Publicidade oculta: "Meu dia foi tão estressante, mas esse sabonete acalmou minha pele. Eu amo!" (Parece uma postagem normal, mas é encenada).

Os pesquisadores descobriram que as IAs mais recentes e inteligentes (como GPT-4o ou Gemini) falham completamente diante dessa camuflagem. Elas são enganadas, exatamente como nós, humanos, também poderíamos ser. Elas frequentemente pensam que é uma postagem normal, ou veem publicidade em toda postagem normal.

🛠️ A solução: Um novo percurso de treinamento (CHASM)

Para melhorar as IAs, os pesquisadores construíram algo novo: CHASM.

Imagine o CHASM como um percurso de treinamento de espião.

  1. Os dados: Eles coletaram quase 5.000 postagens reais da plataforma.
  2. A camuflagem: Havia muitas postagens que realmente pareciam dicas normais, mas eram publicidade oculta. E muitas que pareciam publicidade, mas eram apenas dicas genuínas.
  3. A anonimização: Como um espião usando uma máscara, eles tornaram todos os nomes e rostos nas imagens irreconhecíveis, para que a privacidade de ninguém fosse violada.

🏋️‍♂️ O treinamento: De iniciante a profissional

Os pesquisadores testaram várias IAs nesse percurso:

  • Sem treinamento (Zero-Shot): As IAs entraram sem nunca terem visto algo assim. Resultado: Catástrofe. Elas mal conseguiam encontrar a publicidade oculta. Era como mostrar um filme de espionagem a um iniciante e esperar que ele entendesse imediatamente os códigos ocultos.
  • Com treinamento (Fine-Tuning): Então eles "treinaram" as IAs com o CHASM. Eles mostraram: "Olhe, aqui há um link oculto nos comentários" ou "Aqui apenas uma única marca é elogiada, isso é suspeito."
    • Resultado: As IAs ficaram significativamente melhores! Uma IA (Qwen2.5) pôde, após o treinamento, ficar quase tão boa quanto um moderador humano experiente. Elas aprenderam a prestar atenção nos pequenos detalhes que revelam a fraude.

🔍 O que aprendemos? (A análise de erros)

Mesmo após o treinamento, as IAs ainda cometem erros. Os pesquisadores descobriram onde está o problema:

  1. As pistas ocultas: Muitas vezes, o link de compra não está no texto, mas sim nos comentários ou escondido em uma imagem. As IAs frequentemente ignoram essas pequenas pistas.
  2. A estrutura: Uma publicidade real concentra-se frequentemente em apenas um produto. Um usuário real fala frequentemente sobre várias coisas. As IAs ainda não entendem perfeitamente esse "ritmo".
  3. A linguagem: A publicidade oculta usa frequentemente palavras exageradas ("O melhor de todos os tempos!"), enquanto usuários reais também dizem às vezes: "É bom, mas não perfeito."

🚀 Conclusão: Por que isso é importante?

Esta pesquisa é como um alerta para as plataformas e os desenvolvedores de IA.

  • Para nós, usuários: Mostra que precisamos ter cuidado. Nem todo "amigo" que nos recomenda um produto é um amigo de verdade.
  • Para as plataformas: Elas precisam treinar seus sistemas de IA com dados especiais como o CHASM para desmascarar esses fraudadores.
  • Para o futuro: É uma corrida. Os anunciantes ficarão cada vez mais inteligentes em sua camuflagem, e as IAs precisarão ficar igualmente inteligentes para desmascará-los.

Resumindo: O CHASM é o primeiro grande passo para ensinar a IA a reconhecer o "lobo em pele de cordeiro" nas redes sociais antes que ele nos tire o dinheiro do bolso.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →