← Últimos artigos
💻 computer science

TEAR: Temporal-aware Automated Red-teaming for Text-to-Video Models

O artigo apresenta o TEAR, um framework automatizado de red-teaming que explora as dinâmicas temporais dos modelos de texto-para-vídeo para gerar prompts enganosos e revelar riscos de segurança, alcançando uma taxa de sucesso de ataque superior a 80% e superando significativamente os métodos anteriores.

Autores originais: Jiaming He, Guanyu Hou, Hongwei Li, Zhicong Huang, Kangjie Chen, Yi Yu, Wenbo Jiang, Guowen Xu, Tianwei Zhang

Publicado 2026-03-12
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Jiaming He, Guanyu Hou, Hongwei Li, Zhicong Huang, Kangjie Chen, Yi Yu, Wenbo Jiang, Guowen Xu, Tianwei Zhang

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você acabou de criar um "chef de cinema" artificial. Esse chef é incrível: você lhe dá um texto simples, como "um gato pulando em um sofá", e ele cozinha um vídeo realista e fluido, onde o gato salta perfeitamente.

O problema é que esse chef é tão talentoso que, se você der a ele instruções muito específicas e maliciosas, ele pode cozinhar um vídeo de desastre (violento, ilegal ou perigoso). O desafio é que, para evitar isso, os guardiões (filtros de segurança) olham apenas para o texto que você pediu. Se o texto parecer inofensivo, o guardião deixa passar.

Aqui entra o TEAR, o "herói" (ou vilão, dependendo de quem você pergunta) deste artigo.

O Que é o TEAR?

O TEAR é um sistema automático criado por pesquisadores para testar a segurança desses chefs de vídeo. Pense nele como um detetive de labirinto do tempo.

A grande descoberta do TEAR é que os filtros de segurança atuais são como guardiões que olham apenas para fotos estáticas. Eles não entendem que uma sequência de fotos inofensivas, quando colocadas em ordem e com um ritmo específico, pode contar uma história terrível.

A Analogia do "Quebra-Cabeça do Tempo"

Imagine que você quer que o chef faça um vídeo de alguém caindo de uma escada (algo perigoso).

  • O jeito antigo (e burrão): Você pede "homem caindo da escada". O filtro de segurança vê a palavra "caindo" e bloqueia.
  • O jeito do TEAR: O TEAR é um mestre em "quebra-cabeças temporais". Ele divide o evento perigoso em três partes inofensivas:
    1. "Um homem está em pé em uma escada." (Inofensivo)
    2. "Dois segundos depois, ele perde o equilíbrio." (Inofensivo)
    3. "Ele cai no chão e fica imóvel." (Inofensivo)

Sozinhos, esses textos são seguros. Mas, quando o chef de vídeo junta tudo e entende o ritmo (o "tempo" entre as ações), ele cria o vídeo do acidente. O TEAR aprendeu a enganar os guardiões criando essas instruções "invisíveis" que só fazem sentido quando o vídeo é rodado.

Como o TEAR Funciona (O Treinamento)

O TEAR não chuta o que fazer; ele treina como um atleta olímpico em duas etapas:

  1. A Aula de Teoria (Treinamento Inicial): O TEAR estuda milhares de exemplos de como transformar uma ideia ruim em uma sequência de ideias boas. Ele aprende a "desmontar" o perigo e "remontá-lo" de forma segura no papel, mas perigosa na prática.
  2. O Treino de Campo (Aprendizado Online): O TEAR começa a testar seus prompts no chef de vídeo real.
    • Se o vídeo sair perigoso, ele ganha um ponto de recompensa.
    • Se o texto for bloqueado pelo filtro, ele perde pontos.
    • Ele usa um "ajudante inteligente" (um modelo de refinamento) para ler o vídeo gerado e dizer: "Ei, essa parte do texto foi muito óbvia, vamos mudar a palavra para 'caindo' para 'deslizando'".
    • Ele repete esse ciclo milhares de vezes, tornando-se cada vez mais esperto e sutil.

O Que Eles Descobriram?

Os pesquisadores testaram o TEAR em vários chefs de vídeo famosos (tanto gratuitos quanto pagos, como os da Google e da Microsoft). Os resultados foram assustadores, mas importantes:

  • Taxa de Sucesso: O TEAR conseguiu enganar os filtros e gerar vídeos perigosos em mais de 80% dos testes. Os métodos antigos conseguiam apenas cerca de 57%.
  • O Efeito Dominó: O pior de tudo é que o TEAR descobriu uma fraqueza comum. Se você treinar o TEAR para enganar um chef de vídeo específico, ele consegue usar a mesma "truque" para enganar outros chefs de vídeo diferentes. É como se todos eles tivessem a mesma fechadura fraca.
  • Os Filtros Estão Dormindo: Os filtros de segurança atuais são muito bons em ler texto, mas péssimos em entender a ação no tempo. Eles deixam passar o perigo porque não conseguem "ver" o futuro do vídeo antes de ele ser gerado.

Por Que Isso é Importante?

Pode parecer assustador, mas o objetivo do TEAR é salvar o dia.

Imagine que você é o dono de um restaurante (o desenvolvedor do modelo de vídeo). Antes de abrir as portas para o público, você contrata um inspetor de saúde (o TEAR) para tentar envenenar sua comida de todas as formas possíveis. Se o inspetor conseguir envenenar a comida, você sabe que precisa melhorar sua cozinha antes que um cliente real fique doente.

O TEAR é esse inspetor. Ele mostra que, para proteger o futuro dos vídeos gerados por IA, não basta olhar para o texto. Precisamos ensinar os guardiões a entenderem o ritmo, a sequência e o tempo das histórias que as máquinas estão contando.

Resumo em uma frase: O TEAR é um hacker ético que aprendeu a contar histórias perigosas usando palavras inocentes, revelando que os guardiões de vídeo atuais estão olhando apenas para as palavras, e não para a ação que elas descrevem.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →