← Últimos artigos
💬 NLP

Speaking in Self-Assessing Tongues: On the Verbalized Confidence of LLMs in Machine Translation

Este artigo introduz e avalia cinco métodos verbalizados para extrair confiança por token de modelos de linguagem de grande escala em tradução automática, constatando que eles apresentam desempenho comparável aos sinais internos na detecção e calibração de erros, apesar de mostrarem pouca correlação com eles.

Autores originais: Ali Marashian, Alexis Palmer, Katharina von der Wense

Publicado 2026-06-17
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Ali Marashian, Alexis Palmer, Katharina von der Wense

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você tem um robô tradutor multilíngue muito inteligente. Você pede para ele traduzir uma frase e ele o faz instantaneamente. Mas como você sabe se ele acertou? O robô sabe se cometeu um erro?

Este artigo investiga uma questão específica: Podemos perguntar ao robô, "O quanto você tem certeza sobre esta palavra específica?" e confiar em sua resposta?

Os pesquisadores compararam duas maneiras de obter o "nível de confiança" do robô:

  1. A Maneira "Interna": Observar a matemática secreta do robô (suas probabilidades internas). É como espiar o cérebro do robô para ver quantas opções ele estava considerando antes de escolher uma palavra.
  2. A Maneira "Verbalizada": Simplesmente perguntar ao robô, "Em uma escala de 0 a 1, o quanto você tem certeza desta palavra?" e fazer com que ele digite a resposta.

Aqui está um detalhamento de suas descobertas usando analogias simples:

1. O Problema de "Espiar o Cérebro"

Normalmente, quando queremos saber se uma tradução é boa, olhamos para a matemática interna do robô. Se o robô estivesse 99% seguro de que escolheu a palavra certa, assumimos que ela está correta.

No entanto, o artigo aponta uma falha nesse método chamada "Competição de Forma de Superfície" (Surface Form Competition).

  • A Analogia: Imagine que você está traduzindo "The cat sat on the mat". Você também poderia dizer "The feline sat on the rug". Ambas são traduções perfeitas.
  • O Problema: Se o robô estiver dividido entre "cat" e "feline", sua matemática interna pode mostrar que ele está apenas 50% seguro sobre "cat" porque também está pensando em "feline". Mas "cat" é, na verdade, uma tradução correta!
  • O Resultado: A matemática interna do robô diz: "Estou inseguro", mas a saída é, na verdade, perfeita. O sinal interno é enganoso porque mede a confusão entre opções, não a correção.

2. A Nova Ideia: Apenas Pergunte

Como o robô consegue falar, os pesquisadores tentaram uma abordagem diferente: Confiança Verbalizada. Em vez de espiar a matemática, eles estimularam o robô a dizer: "Estou 90% seguro de que esta palavra está certa".

Eles testaram cinco maneiras de perguntar:

  • A Lista: "Diga quais partes da frase estão erradas."
  • Números de Palavras: "Dê a cada palavra uma pontuação de 0 a 1."
  • Palavras de Palavras: "Dê a cada palavra um rótulo como 'Muito Certo' ou 'Não Tenho Certeza'."
  • Números/Palavras de Tokens: Fazer o mesmo para pequenos pedaços de palavras (tokens) em vez de palavras inteiras.

3. A Grande Surpresa: Eles Não Concordam

Os pesquisadores esperavam que, se a matemática interna do robô dissesse "Estou inseguro" e eles perguntassem ao robô "Você está inseguro?", o robô diria "Sim".

Eles estavam errados.

  • A Analogia: É como um meteorologista que olha para seus dados complexos de radar (Interno) e diz: "Há 50% de chance de chuva", mas quando você pergunta diretamente a ele: "Você acha que vai chover?", ele diz: "Tenho 90% de certeza de que não vai".
  • A Descoberta: Houve quase nenhuma correlação entre a matemática interna do robô e o que ele disse em voz alta. Eles eram essencialmente duas estratégias diferentes que não se comunicavam de verdade.

4. Perguntar Ajudou?

Então, se eles não concordam, qual deles é melhor em detectar erros reais de tradução?

  • Os Resultados: Surpreendentemente, perguntar ao robô (Verbalizado) funcionou tão bem quanto, e às vezes melhor do que, espiar a matemática (Interno).
  • O Detalhe: Depende de qual robô você usa.
    • Para um modelo (Llama3), pedir ao robô para dar uma pontuação "Likert" (ex: "Muito Certo") funcionou melhor.
    • Para outro modelo (Aya23), olhar para a matemática interna (Entropia) funcionou melhor.
  • A Verificação de Realidade: Mesmo o melhor método não era perfeito. Os robôs ainda eram apenas moderadamente bons em detectar seus próprios erros. É como um aluno fazendo uma prova que é razoavelmente bom em saber quais respostas estão erradas, mas ainda comete alguns erros que não percebe.

5. Por Que Isso Importa (Segundo o Artigo)

O artigo conclui que não precisamos ser "hackers" olhando dentro do código do robô para obter uma pontuação de confiança. Podemos apenas perguntar a ele.

  • Acessibilidade: Você não precisa de acesso à "mente" interna do robô (que é frequentemente oculta em modelos de código fechado). Você só precisa ser capaz de conversar com ele.
  • Granularidade: Os pesquisadores descobriram que, mesmo quando pediam um número preciso (como 0,83), os robôs tendiam a arredondar suas respostas para etapas simples (como 0,8 ou 0,9), agindo mais como se estivessem usando uma lista de verificação simples do que uma calculadora de alta precisão.

Resumo

O artigo é um teste para saber se podemos confiar nas próprias palavras de um Grande Modelo de Linguagem sobre sua confiança.

  • Jeito Antigo: Olhar para a matemática (Interno).
  • Novo Jeito: Perguntar ao modelo (Verbalizado).
  • Veredito: Eles são coisas totalmente diferentes, mas perguntar ao modelo funciona tão bem quanto olhar para a matemática para encontrar erros de tradução. É uma maneira mais simples e acessível de verificar se uma tradução provavelmente é ruim, sem precisar ver o código secreto do modelo.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →