← Últimos artigos
💬 NLP

Lingo_Research_Group at SemEval-2026 Task 9: Evaluating Prompt Variants for Polarization Detection

O artigo do Lingo_Research_Group apresenta uma avaliação sistemática de doze variantes de prompts utilizando o modelo Gemma3-27B para a Tarefa 9 do SemEval-2026, demonstrando que, embora as abordagens baseadas em prompts detectem efetivamente a polarização de granularidade grossa em 22 idiomas, elas enfrentam desafios crescentes na classificação sociolinguística de granularidade fina e multirrótulo.

Autores originais: Pritam Kadasi, Anuj Tiwari, Mayank Singh

Publicado 2026-06-03
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Pritam Kadasi, Anuj Tiwari, Mayank Singh

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você é um detetive tentando resolver um mistério que acontece em 22 idiomas diferentes ao redor do mundo. O mistério não é sobre uma joia roubada, mas sobre algo chamado "polarização". Em termos simples, polarização é quando as pessoas nas redes sociais começam a gritar umas com as outras, traçando linhas rígidas entre "nós" e "eles", e se recusando a ouvir o outro lado.

A equipe por trás deste artigo, Lingo Research Group, entrou em um concurso global (SemEval-2026) para ver se conseguiam ensinar um computador superinteligente (uma IA) a detectar esse combate, descobrir sobre quem eles estão brigando e como eles estão brigando.

Aqui está como eles fizeram isso, explicado com algumas analogias do cotidiano:

Os Três Níveis do Mistério

O concurso tinha três níveis de dificuldade, como um videogame:

  1. Nível 1 (O teste "Isso está acontecendo?"): A IA só precisa responder "Sim" ou "Não". Este post é raivoso e divisivo, ou é apenas um post normal?
    • Analogia: Como um detector de fumaça. Ele só precisa dizer: "Há fumaça?".
  2. Nível 2 (O teste "Sobre quem é isso?"): Se o post for polarizado, sobre quem eles estão brigando? Políticos? Uma raça específica? Uma religião? Gênero?
    • Analogia: Como um detetive perguntando: "Quem é o suspeito?". A IA tem que escolher um ou mais suspeitos de uma fileira de identificação.
  3. Nível 3 (O teste "Como eles estão brigando?"): Este é o nível mais difícil. Como o ódio está sendo expresso? Eles estão usando estereótipos? Estão xingando as pessoas? Estão agindo como se não se importassem com os sentimentos dos outros?
    • Analogia: Como analisar o estilo da briga. Eles estão usando uma faca, um objeto contundente ou apenas gritando? Isso requer detectar comportamentos sutis e complicados.

A Ferramenta: O "Prompt" como uma Receita

Em vez de ensinar o computador mostrando a ele milhares de exemplos (o que seria como forçar um aluno a memorizar um livro didático), a equipe usou prompts. Pense em um prompt como uma receita ou um conjunto de instruções dados a um chef muito talentoso, mas de pensamento literal (a IA).

A equipe testou 12 receitas diferentes.

  • Algumas receitas eram muito curtas: "Isso é raivoso?"
  • Outras eram detalhadas: "Procure por palavras que separam as pessoas em grupos. Se você vir sarcasmo, verifique se ele é maldoso. Aqui estão três exemplos do que isso parece..."

Eles testaram essas receitas em dois "chefs" (modelos de IA) diferentes: aya-101 e Gemma3-27B. Eles descobriram que o Gemma3-27B era o melhor chef, por isso o usaram para o concurso final.

Os Resultados: Bons no Básico, Lutando com a Nuance

Os resultados da equipe foram uma mistura de sucesso e dificuldade, o que conta uma história interessante:

  • Nível 1 (Detector de Fumaça): A IA foi muito boa nisso. Ela identificou corretamente posts polarizados cerca de 76% das vezes em média. É como um detector de fumaça que raramente perde um incêndio.
  • Nível 2 (Os Suspeitos): A pontuação caiu para cerca de 59%. Foi mais difícil apontar exatamente quem estava sendo atacado.
  • Nível 3 (O Estilo de Briga): A pontuação caiu ainda mais para cerca de 44%. Esta foi a parte mais difícil.

Por que ficou mais difícil?
Os autores explicam que, conforme a tarefa se torna mais específica, a IA fica confusa.

  • O Problema do "Chef Conservador": A IA foi treinada para ser muito cuidadosa. Ela só dizia "Sim, isso é polarizado" se a evidência fosse super óbvia (como alguém gritando um insulto pesado).
  • A Armadilha do Sarcasmo: Em inglês, as pessoas costem lutar usando sarcasmo, ironia ou jogos de palavras inteligentes (ex: "Ah, ótimo, outro socialista em nome de Jesus"). A IA, sendo muito literal, perdia essas nuances porque não havia "palavras de briga" óbvias. Ela pensava: "Não há insultos diretos? Então deve ser seguro".
  • A Lacuna entre o Direto e o Indireto: Em muitos outros idiomas (como hindi ou chinês), as pessoas costumam ser mais diretas em seus argumentos. A IA foi ótima em detectar esses golpes diretos, mas teve dificuldade com os argumentos sutis e indiretos do inglês.

O Quebra-Cabeça Linguístico

A IA não teve o mesmo desempenho em todos os idiomas.

  • Nepalês e Chinês foram fáceis para a IA porque a polarização era frequentemente muito clara e direta (como "Grupo A vs. Grupo B").
  • Inglês foi surpreendentemente difícil. Como os falantes de inglês usam muito sarcasmo e códigos culturais, a IA continuava perdendo as brigas. É como tentar entender uma piada em uma língua que você não domina totalmente; você ouve as palavras, mas perde a graça.

A Grande Conclusão

O artigo conclui que a IA é ótima para detectar as brigas "barulhentas" (Nível 1), mas tem dificuldade com as brigas "silenciosas" ou "inteligentes" (Níveis 2 e 3).

A equipe aprendeu que você não pode apenas dar uma instrução simples a uma IA e esperar que ela entenda emoções humanas complexas através de 22 culturas diferentes. Quanto mais você pede para ela analisar a nuance (o "como" e o "quem"), mais ela tende a perder os sinais sutis, especialmente quando as pessoas estão sendo sarcásticas ou indiretas.

Em resumo: A IA é um bom detetive para crimes óbvios, mas precisa de mais treinamento para entender as formas sutis, complicadas e sarcásticas como as pessoas discutem online.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →