← Últimos artigos
💬 NLP

Surprisal and Metaphor Novelty Judgments: Moderate Correlations and Divergent Scaling Effects Revealed by Corpus-Based and Synthetic Datasets

Este estudo demonstra que, embora a surprisal de modelos de linguagem apresente correlações moderadas com anotações de novidade de metáforas, ela exibe comportamentos de escala divergentes — diminuindo em poder preditivo com modelos maiores em dados baseados em corpora, mas aumentando em dados sintéticos — destacando suas limitações como uma métrica abrangente para a criatividade linguística.

Autores originais: Omar Momen, Emilie Sitter, Berenike Herrmann, Sina Zarrieß

Publicado 2026-01-27
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Omar Momen, Emilie Sitter, Berenike Herrmann, Sina Zarrieß

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você esteja tentando adivinhar a próxima palavra em uma frase. Se a frase for "O gato sentou no...", seu cérebro (e um programa de computador) pode facilmente adivinhar "tapete". Isso era fácil de prever, então não foi muito surpreendente. Mas se a frase for "O gato sentou no... água-viva", seu cérebro dá uma dupla tomada. Essa palavra foi difícil de prever, então tem um alto nível de "surpresa" (surprisal).

Este artigo faz uma pergunta simples: Será que esse sentimento de "surpresa" pode nos ajudar a distinguir entre uma metáfora velha e entediante e uma nova e criativa?

A Grande Ideia: Previsibilidade vs. Criatividade

Metáforas são como pontes mentais. Às vezes, a ponte é um caminho bem trilhado que todos conhecem, como dizer "Eu ataquei o argumento dele". Todo mundo sabe que você não usa uma arma contra um discurso; é uma frase padrão. Esta é uma metáfora convencional.

Outras vezes, a ponte é nova e instável, como dizer "A água arrestada". Você precisa parar e pensar: Como a água pode ser arrestada? Não está no dicionário. Esta é uma metáfora novel (nova).

Os pesquisadores queriam ver se programas de computador (chamados de Modelos de Linguagem) poderiam usar seu "medidor de surpresa" para detectar essas pontes novas e criativas. A teoria era: Se uma palavra é difícil de prever, talvez seja uma metáfora criativa.

O Experimento: Dois Mundos Diferentes

A equipe testou essa ideia usando dois tipos de dados muito diferentes, e os resultados foram como um conto de duas cidades:

1. A Cidade do "Mundo Real" (Dados Baseados em Corpus)
Eles observaram frases reais tiradas de livros, notícias e conversas.

  • O Resultado: Aqui, o "medidor de surpresa" funcionou razoavelmente bem, mas com uma reviravolta. Modelos de computador menores e mais simples foram, na verdade, melhores em detectar as metáforas criativas do que os modelos gigantes e superinteligentes.
  • A Analogia: Imagine um detetive local pequeno que conhece bem o bairro. Eles percebem as coisas estranhas e novas porque não estão pensando demais. O detetive gigante (a IA grande) viu tantos dados que começa a esperar coisas estranhas em todos os lugares, tornando-se menos sensível ao que é realmente "novo" em uma frase específica. Quanto maior o modelo ficava, pior ele se tornava nesta tarefa específica.

2. A Cidade da "Fábrica de Brinquedos" (Dados Sintéticos)
Eles também usaram frases que foram cuidadosamente construídas em um laboratório (ou por outra IA) onde a única diferença era se a metáfora era antiga ou nova.

  • O Resultado: Aqui, as regras mudaram. Os modelos maiores e mais inteligentes ficaram muito melhores em detectar as metáções criativas.
  • A Analogia: Em uma fábrica de brinquedos controlada, o detetive gigante brilha. Como os brinquedos são perfeitos e as regras são rígidas, o cérebro massivo pode usar seu enorme poder para ver as sutilezas que o pequeno detetive perde.

O Truque "Cloze": Olhando para Ambos os Lados

Os pesquisadores também tentaram um novo truque. A "surpresa" padrão olha apenas para as palavras antes da palavra alvo (como ler uma frase da esquerda para a direita). Mas para entender uma metáfora, muitas vezes é necessário ver o que vem depois dela também.

Eles criaram um método "Cloze" (como um jogo de completar lacunas). Eles esconderam a palavra metafórica, mostraram o modelo a frase inteira (incluindo o final) e perguntaram: "Que palavra vai aqui?"

  • O Resultado: Essa abordagem de "olhar para ambos os lados" geralmente tornou o computador mais inteligente ao detectar as metáforas. Foi como dar ao detetive um mapa de toda a rua em vez de apenas a esquina onde eles estavam parados. No entanto, este truque funcionou melhor para as frases do "Mundo Real" e às vezes confundiu os modelos nas frases da "Fábrica de Brinquedos".

E Quanto a Ensinar a IA a Falar como um Humano?

A equipe também tentou usar modelos "Instruídos por Instrução" (IA que foi ensinada a seguir instruções humanas e conversar de forma amigável).

  • O Resultado: Surpreendentemente, fazer a IA falar mais como um humano não a tornou melhor em detectar metáforas criativas. Na verdade, para alguns modelos, isso as tornou piores neste problema matemático específico. Ser "conversadeira" não ajudou a ser "criativa".

A Conclusão

O artigo conclui que a "surpresa" (surprisal) é uma ferramenta razoável para encontrar metáforas criativas, mas não é uma varinha mágica.

  • Funciona moderadamente bem (cerca de 40-50% de correlação), o que significa que é útil, mas longe de ser perfeita.
  • O contexto importa: Se a IA está olhando para textos bagunçados do mundo real ou textos limpos de laboratório, tudo muda.
  • O tamanho importa: Maior nem sempre é melhor; às vezes o menor é mais aguçado, dependendo dos dados.

Em resumo, embora os computadores possam ter um vislumbre da criatividade humana ao medir o quão "surpresos" estão, eles ainda lutam para compreender totalmente a magia de uma metáfora verdadeiramente nova. Eles precisam de mais do que apenas um medidor de surpresa para entender a arte da linguagem.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →