← Últimos artigos
💬 NLP

Can LLMs Refuse Questions They Do Not Know? Measuring Knowledge-Aware Refusal in Factual Tasks

Este artigo apresenta o Índice de Recusa (RI), uma métrica inovadora baseada na correlação entre as probabilidades de recusa e de erro, para medir e revelar eficazmente as capacidades de recusa consciente do conhecimento, frequentemente pouco confiáveis, dos Modelos de Linguagem de Grande Porte em tarefas factuais.

Autores originais: Wenbo Pan, Jie Xu, Qiguang Chen, Junhao Dong, Libo Qin, Xinfeng Li, Haining Yu, Xiaohua Jia

Publicado 2026-05-19
📖 4 min de leitura☕ Leitura rápida

Autores originais: Wenbo Pan, Jie Xu, Qiguang Chen, Junhao Dong, Libo Qin, Xinfeng Li, Haining Yu, Xiaohua Jia

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

O Grande Problema: O Aluno Excessivamente Confiante

Imagine um aluno fazendo um teste de história muito difícil. Um aluno verdadeiramente inteligente sabe quando não conhece uma resposta e levanta a mão para dizer: "Não tenho certeza sobre esta". No entanto, os Modelos de Linguagem de Grande Porte (LLMs) são frequentemente como um aluno que é excessivamente confiante. Mesmo quando não têm ideia de qual é a resposta, eles inventam uma história com confiança (uma "alucinação") em vez de admitir que não sabem.

Isso é perigoso porque, se você pedir a uma IA conselhos médicos ou jurídicos, você precisa que ela diga "Não sei" se estiver insegura, em vez de fornecer informações erradas com confiança.

A Antiga Maneira de Medir: Contando Erros

Anteriormente, os pesquisadores tentavam medir quão boa uma IA é nisso observando dois números simples:

  1. Com que frequência ela se recusa a responder.
  2. Com que frequência ela acerta a resposta.

O artigo argumenta que esses métodos são falhos. É como julgar um aluno apenas pela quantidade de vezes que ele levantou a mão para dizer "Não sei".

  • Se você disser ao aluno: "Por favor, diga 'Não sei' para tudo", ele levantará a mão 100% das vezes. Mas isso não significa que ele é inteligente; significa apenas que está seguindo ordens.
  • Se você disser a ele: "Responda a tudo, não importa o que aconteça", ele pode acertar mais perguntas, mas também dará respostas erradas com confiança.

As antigas métricas não conseguiam distinguir entre um aluno que se recusa sabiamente a perguntas difíceis e um que se recusa ou responde apenas de forma aleatória.

A Nova Solução: O "Índice de Recusa" (IR)

Os autores criaram uma nova pontuação chamada Índice de Recusa (IR). Pense nisso como uma "Pontuação de Verdade".

Em vez de apenas contar quantas vezes a IA diz "Não sei", o IR pergunta: "A IA diz 'Não sei' especificamente quando a pergunta é difícil, e ela responde quando a pergunta é fácil?"

  • IR Alto: A IA age como um bibliotecário sábio. Ela recusa perguntas obscuras e impossíveis, mas responde feliz às fáceis. Ela conhece a diferença.
  • IR Baixo: A IA age como um robô confuso. Ela pode recusar perguntas fáceis que poderia responder, ou pode responder com confiança a perguntas impossíveis. Seu comportamento de "recusa" é aleatório ou quebrado.

Como Eles Mediram: O Truque de "Duas Passadas"

Para calcular essa pontuação sem precisar conhecer os "pensamentos" internos da IA (que não podemos ver), os pesquisadores usaram um Truque de Duas Passadas engenhoso:

  1. Passada 1 (O Teste Honesto): Eles fazem uma série de perguntas à IA e deixam ela decidir: "Você quer responder ou quer dizer 'Não sei'?" Eles registram quais ela recusou.
  2. Passada 2 (A Resposta Forçada): Eles pegam apenas as perguntas que a IA recusou na primeira rodada. Eles voltam e dizem: "Ok, você deve responder a essas agora, sem pulos permitidos". Eles veem se a IA realmente poderia ter acertado se tivesse tentado.

Ao comparar as duas rodadas, eles podem ver se a IA foi inteligente o suficiente para recusar as perguntas que não conseguia responder. Se a IA recusou as difíceis na Passada 1, mas errou na Passada 2, ela tem um Índice de Recusa Alto.

O Que Eles Descobriram

Os pesquisadores testaram 16 modelos de IA diferentes (como GPT-4, Claude, Llama, etc.) e encontraram algumas coisas surpreendentes:

  1. Precisão Não Garante Sabedoria: Apenas porque uma IA é muito boa em responder perguntas (alta precisão) não significa que ela sabe quando parar. Alguns modelos muito inteligentes ainda chutam com confiança coisas que não sabem.
  2. A "Família" Importa Mais: O fator mais importante para saber se uma IA sabe quando recusar não é o tamanho dela ou quantas perguntas ela acerta. É qual empresa a criou. Algumas "famílias" de IA (como Claude e Qwen) agem consistentemente com mais sabedoria do que outras (como Gemini ou GPT-4.1), independentemente do tamanho.
  3. O Contexto é Fundamental: Se você der um documento para a IA ler e fizer uma pergunta que não está no documento, a IA fica confusa. Ela frequentemente falha em recusar, tentando chutar com base em seus próprios dados de treinamento em vez de se ater ao documento.

A Conclusão

O artigo conclui que precisamos de uma nova maneira de julgar a IA. Não devemos apenas perguntar: "Quantas perguntas você acertou?" Também precisamos perguntar: "Você sabia quando parar e dizer 'Não sei'?"

O Índice de Recusa é a nova régua para isso. Ele nos ajuda a encontrar modelos de IA que não são apenas inteligentes, mas também húmeis e confiáveis o suficiente para admitir seus limites.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →