On Verbalized Confidence Scores for LLMs
Este artigo investiga a confiabilidade de Modelos de Linguagem Grandes ao verbalizar sua própria incerteza por meio de pontuações de confiança, demonstrando que, embora a eficácia varie conforme a estratégia de prompt, métodos específicos podem produzir quantificação de incerteza bem calibrada e agnóstica ao modelo com baixa sobrecarga.
Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo
Imagine que você está pedindo conselho a um amigo muito inteligente e bem informado. Às vezes, eles têm absoluta certeza sobre sua resposta, e às vezes estão apenas chutando. O problema com os Modelos de Linguagem de Grande Porte (LLMs) de hoje é que eles frequentemente soam confiantes mesmo quando estão errados. Eles são como um amigo que nunca diz "Não tenho certeza", mesmo quando não faz ideia sobre o que está falando.
Este artigo, "Sobre Pontuações de Confiança Verbalizadas para LLMs", investiga uma ideia simples: E se simplesmente pedirmos à IA para nos dizer o quão certa ela está?
Em vez de examinar o código interno da IA ou executá-la cem vezes para ver se ela dá a mesma resposta, os pesquisadores simplesmente pediram à IA para adicionar uma "pontuação de confiança" à sua resposta, como dizer: "A resposta é X, e tenho 85% de certeza."
Aqui está uma análise de suas descobertas usando analogias do dia a dia:
1. O Objetivo: Um "Medidor de Confiança"
Os pesquisadores queriam ver se esse "medidor de confiança" (a pontuação de confiança) realmente funciona. Eles desejavam um sistema que:
- Seja Honesto: Se a IA diz que tem 90% de certeza, ela deve estar correta 90% das vezes.
- Seja Flexível: Deve funcionar independentemente da pergunta feita ou do modelo de IA utilizado.
- Seja Rápido: Não deve exigir tempo ou poder de computação extras para obter a pontuação.
2. O Experimento: Testando Diferentes "Formas de Perguntar"
A equipe percebeu que como você pergunta à IA importa muito. É como pedir a uma criança para chutar.
- Se você perguntar: "Qual é a capital da França? Chute!", ela pode apenas dizer "Paris" e sentir-se confiante.
- Se você perguntar: "Qual é a capital da França? Chute e me diga o quão certo você está em uma escala de 0 a 100", ela pode pensar mais.
Os pesquisadores testaram 17 maneiras diferentes de formular a pergunta (prompts) em 11 modelos de IA diferentes e 10 tipos diferentes de perguntas (como trivia científica, quebra-cabeças de lógica e senso comum).
3. A Grande Descoberta: Depende do "Tamanho do Cérebro" da IA
A descoberta mais interessante é que a melhor maneira de obter uma resposta honesta depende de quão "inteligente" (ou grande) é o modelo de IA.
Para Modelos de IA "Pequenos" (Os Novatos):
Pense neles como estudantes que ainda estão aprendendo. Se você der a eles um prompt complexo e rebuscado, com muitos exemplos e instruções, eles ficam confusos e começam a inventar coisas.- A Descoberta do Artigo: Prompts simples funcionam melhor. Apenas perguntar a eles de forma simples, "O quão certo você está?", funciona melhor do que dar uma longa lista de regras.
Para Modelos de IA "Grandes" (Os Especialistas):
Pense neles como doutores. Eles têm muito conhecimento, mas podem ser excessivamente confiantes. Se você apenas perguntar a eles de forma simples, eles ainda podem chutar com 100% de confiança, mesmo quando errados.- A Descoberta do Artigo: Eles precisam de um "empurrão" mais complexo. Os pesquisadores descobriram que combinar várias técnicas — como dar a eles alguns exemplos de como responder, pedir que expliquem seu raciocínio e dizer explicitamente que considerem a dificuldade da tarefa — tornava-os muito mais honestos.
- O Resultado: Com o prompt complexo adequado, esses modelos grandes podiam produzir pontuações de confiança que eram precisas dentro de cerca de 7% de sua taxa de sucesso real. Isso é uma enorme melhoria em relação a apenas chutar.
4. O Prompt "Combo"
Os pesquisadores criaram um "super-prompt" (chamado combo) para os modelos grandes. Era como dar à IA uma lista de verificação:
- Pense sobre a pergunta.
- Considere o quão difícil ela é.
- Examine seu próprio conhecimento.
- Dê sua melhor aposta.
- Forneça uma pontuação de probabilidade (0,0 a 1,0).
Quando usaram esse prompt "combo", os modelos grandes ficaram muito melhores em admitir quando não tinham certeza.
5. O Que Isso Significa (Segundo o Artigo)
O artigo conclui que pedir a uma IA para "falar sua confiança" é uma ferramenta muito promissora. Ela é:
- Simples: Você não precisa ver dentro do cérebro da IA.
- Rápida: Leva apenas algumas palavras extras para gerar.
- Eficaz: Se você souber como fazer a pergunta certa, a IA pode dizer quando está chutando e quando conhece a resposta.
No entanto, há uma pegadinha: Você não pode perguntar a qualquer IA de qualquer maneira que quiser. Você precisa adaptar a pergunta. Se você fizer uma pergunta complexa a uma IA pequena, ela falhará. Se você fizer uma pergunta simples a uma IA grande, ela pode mentir sobre estar confiante. Mas com a "receita" certa para o prompt, podemos fazer com que esses modelos sejam muito mais confiáveis.
Em resumo: A IA pode dizer o quão certa ela está, mas você precisa saber como fazê-la a pergunta certa para obter uma resposta verdadeira.
Afogado em artigos na sua área?
Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.