← Últimos artigos
🤖 AI

A Unified Definition of Hallucination: It's The World Model, Stupid!

Este artigo propõe uma definição unificada de alucinação como um modelamento de mundo interno impreciso observável ao usuário, argumentando que este framework subsume definições anteriores, esclarece padrões de avaliação ao especificar mundos de referência e distingue alucinações de outros tipos de erro para facilitar melhores estratégias de benchmarking e mitigação.

Autores originais: Emmy Liu, Varun Gangal, Chelsea Zou, Michael Yu, Xiaoqi Huang, Alex Chang, Zhuofu Tao, Karan Singh, Sachin Kumar, Steven Y. Feng

Publicado 2026-06-16
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Emmy Liu, Varun Gangal, Chelsea Zou, Michael Yu, Xiaoqi Huang, Alex Chang, Zhuofu Tao, Karan Singh, Sachin Kumar, Steven Y. Feng

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você está jogando uma partida de "Telefone Sem Fio" com um robô muito inteligente, mas um pouco confuso. Você dá ao robô uma história, uma imagem ou um conjunto de regras e pede que ele conte o que aconteceu. Às vezes, o robô conta algo que parece confiante e fluente, mas que é completamente inventado. No mundo da tecnologia, chamamos isso de alucinação.

Mas aqui está o problema: todos discutem sobre o que exatamente conta como uma alucinação.

  • Se um robô resume um artigo de notícias e erra um fato, é uma alucinação?
  • Se um robô responde a uma pergunta de conhecimentos gerais de sua memória e erra, é uma alucinação?
  • Se um robô tenta clicar em um botão em um site que não existe, é uma alucinação?

Alguns pesquisadores dizem "sim" para todos eles. Outros dizem "não, isso é apenas um erro". Essa confusão torna difícil corrigir o problema.

Este artigo argumenta que precisamos parar de discutir a definição e começar a olhar para a causa raiz. Os autores propõem uma ideia simples e unificada: A alucinação é apenas um "Modelo de Mundo" quebrado.

A Ideia Central: O Mapa Interno do Robô

Pense no robô como um explorador tentando navegar por uma cidade. Para fazer isso, ele precisa de um mapa (um Modelo de Mundo).

  • O Mundo de Referência: Este é o mapa real. É a verdade absoluta. Pode ser o artigo de notícias que você deu a ele, as regras reais do xadrez, o banco de dados real de uma empresa ou o código ao vivo de um site.
  • A Visão do Robô: Isso é o que o robô realmente tem permissão para ver. Talvez ele veja o artigo inteiro, ou talvez veja apenas um pequeno trecho.
  • A Regra de Conflito: Este é o árbitro. Se a memória do robô diz "O céu é verde", mas o artigo diz "O céu é azul", quem vence? Geralmente, o artigo (o Mundo de Referência) vence.

A Definição do Artigo:
Uma alucinação ocorre apenas quando a saída do robô contradiz o Mundo de Referência com base na Regra de Conflito.

Se o robô diz "O céu é verde" e o Mundo de Referência (o artigo) diz "O céu é azul", o robô tem um mapa quebrado. Ele está alucinando.

Por Que Isso Unifica Tudo

Os autores mostram que todos os diferentes tipos de "alucinações" de que as pessoas falam são, na verdade, a mesma coisa acontecendo em salas diferentes:

  1. Sumarização: O "Mundo de Referência" é o documento de origem. Se o resumo contradiz o documento, o mapa do robô sobre esse documento está errado.
  2. Trivia (QA Aberto): O "Mundo de Referência" são os fatos reais do universo (ex: quem ganhou o Prêmio Nobel). Se o robô adivinha errado com base em seu treinamento, seu mapa interno da realidade está errado.
  3. Navegação Web (Agentes): O "Mundo de Referência" é o código real do site (o DOM). Se o robô diz "Eu cliquei no botão Enviar", mas o código mostra que tal botão não existe, o robô está alucinando um objeto que não está lá.

A Parte "Estúpida": É o Mapa, Não o Robô

O título diz, "É o Modelo de Mundo, Estúpido!" Isso é uma brincadeira com um famoso slogan político. Os autores estão dizendo: Pare de culpar o robô por estar "confuso". O problema é que o mapa interno dele do mundo é impreciso.

Às vezes o robô não está "mentindo"; ele está apenas olhando para o mapa errado.

  • Erro de Planejamento: O robá sabe que o mapa está certo, mas escolhe um caminho ruim. (Não é uma alucinação).
  • Alucinação: O robô pensa que o mapa diz "Ponte aqui", mas o mapa na verdade diz "Penhasco". (Isso é uma alucinação).

Como Corrigir (De Acordo com o Artigo)

O artigo sugere que paremos de tentar construir um "robô perfeito" e comecemos a construir melhores campos de teste.

Eles propõem o uso de mundos sintéticos (como videogames ou xadrez) para testar os robôs.

  • A Analogia do Xadrez: Imagine um jogo de xadrez onde as regras são 100% claras e o estado do tabuleiro é 100% conhecido. Podemos perguntar ao robô: "O cavalo branco pode saltar para esta casa?".
  • Se o robô disser "Sim" mas as regras disserem "Não", sabemos exatamente que o mapa interno dele do tabuleiro de xadrez está quebrado.
  • Como o "Mundo de Referência" (as regras do xadrez) é perfeitamente definido por um computador, não precisamos de humanos para adivinhar se o robô está mentindo. O computador sabe instantaneamente.

Por Que Isso Importa

Ao concordarem com esta definição, os pesquisadores podem finalmente:

  1. Comparar maçãs com maçãs: Podemos dizer se uma nova técnica realmente reduz as alucinações ou se ela apenas mudou as regras do jogo.
  2. Saber o que consertar: Se um robô está alucinando porque não consegue ver o documento inteiro, nós consertamos a "Visão". Se ele está alucinando porque ignora o documento em favor de sua memória, nós consertamos a "Regra de Conflito".
  3. Construir testes maiores: Podemos criar milhares de cenários de teste (como milhões de quebra-cabeças de xadrez) onde sabemos a resposta 100% das vezes, sem precisar de humanos para avaliar cada um deles.

Em resumo: O artigo diz: "Pare de discutir o que uma alucinação é. É simplesmente quando a história do robô não corresponde à realidade contra a qual concordamos em testar. Vamos construir melhores mapas e melhores testes para que possamos consertar a bússola quebrada do robô".

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →