← Últimos artigos
🤖 machine learning

Frustratingly Simple Black-Box Adaptation of Language Models via Logit Bias

Este artigo apresenta um método de adaptação de caixa-preta e leve que aprende um único vetor de viés de logit independente de contexto por meio de um objetivo de aprendizado por reforço regularizado por KL para melhorar o desempenho de modelos de linguagem em tarefas de raciocínio sem modificar os pesos do modelo ou exigir acesso ao gradiente.

Autores originais: Ofek I. Cohen, Lior Shani, Aviv Rosenberg, Ankur Samanta, Tal Wagner, Yonathan Efroni

Publicado 2026-07-28
📖 4 min de leitura☕ Leitura rápida

Autores originais: Ofek I. Cohen, Lior Shani, Aviv Rosenberg, Ankur Samanta, Tal Wagner, Yonathan Efroni

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você tem um robô chef brilhante e onisciente que consegue cozinhar quase qualquer prato que você pedir. Este robô é tão inteligente que foi treinado com toda a internet, mas também é um pouco diva: ele não deixa você entrar na cozinha para mudar suas receitas, e você nem sequer pode espiar seus potes de temperos secretos. Você só pode dar uma ordem, e ele começa a cozinhar. Às vezes, o robô é muito tagarela, adicionando histórias desnecessárias antes da receita. Outras vezes, ele esquece de colocar o sal ou fica confuso e começa a falar sobre a história dos tomates em vez de fazer o molho.

No mundo da inteligência artificial, este robô é um "Modelo de Linguagem de Grande Escala" (LLM). A "cozinha" é o cérebro interno do modelo, e as "receitas" são a matemática que ele usa para prever a próxima palavra em uma frase. Geralmente, se você quiser que o roboto seja melhor em um trabalho específico — como resolver problemas matemáticos ou escrever e-mails curtos — você tem que enviá-lo de volta à fábrica para ser retreinado. Mas e se você não puder fazer isso? E se o robô estiver trancado em uma caixa preta e você tiver apenas um único e minúsculo botão de controle? Este artigo faz uma pergunta simples, quase atrevida: Podemos apenas ajustar esse único botão para tornar o robô mais inteligente, sem nunca tocar em seu céreio?

Os pesquisadores, uma equipe da Universidade de Tel Aviv e do Google, decidiram tentar exatamente isso. Eles se concentraram em um recurso chamado "logit bias". Pense no cérebro do robô como um cardápio gigante de cada palavra possível que ele poderia dizer a seguir. Antes de escolher uma palavra, ele atribui uma "pontuação" a cada item no cardápio. O "logit bias" é apenas uma forma de adicionar secretamente alguns pontos a algumas palavras e subtrair pontos de outras antes que o robô faça sua escolha. É como sussurrar para o robô: "Ei, eu gosto muito da palavra 'resposta' e realmente não gosto da palavra 'hum'".

A grande ideia da equipe foi encontrar o sussurro perfeito. Eles queriam aprender uma lista única e fixa de ajustes de pontuação que funcionaria para todas as perguntas que o robô recebesse. Eles não queriam mudar o cérebro do robô; eles apenas queriam dar um empurrão em suas escolhas. Para fazer isso, usaram um truque inteligente: deixaram o robô cozinhar várias refeições, verificaram se eram boas (usando um sistema de recompensa) e depois calcularam exatamente quais palavras deveriam ter recebido um "bônus" para tornar a refeição melhor. Eles usaram um método estatístico chamado "escore de propensão inversa", que é basicamente uma forma de dizer: "Se o robô escolheu uma palavra por acidente, o quanto teríamos amado se ele a tivesse escolhido de propósito?"

Os resultados foram surpreendentemente eficazes, embora com alguns limites. Quando aplicaram esse "sussurro" aprendido a testes de matemática e raciocínio, o robô tornou-se ligeiramente melhor na resolução de problemas. Por exemplo, em um benchmark matemático difícil chamado MATH, a precisão do robô passou de cerca de 30,3% para 33,1%. Não é um salto enorme, mas é uma melhoria real alcançada sem mudar um único peso no cérebro do robô. Ainda mais interessante, eles usaram este método para tornar o robô mais curto e conciso. Ao ajustar o viés, eles conseguiram convencer o robô a parar de falar mais cedo, reduzindo o comprimento de suas respostas em alguns modelos de mais de 900 palavras para menos de 900, sem perder a resposta correta.

No entanto, o artigo é muito claro sobre o que este método não pode fazer. Os pesquisadores descobriram que, embora este "sussurro" seja ótimo para formatação, impedir que o robô divague ou direcioná-lo para o estilo de resposta correto, ele não consegue ensinar nova lógica ao robô. Se o robô não sabe como resolver um problema matemático específico, adicionar um viés não lhe dará subitamente as habilidades matemáticas que lhe faltam. É como um treinador que pode dizer a um jogador para "correr mais rápido" ou "parar de se inquietar", mas não pode ensinar como jogar o jogo se ele não conhece as regras. O artigo sugere que este método é uma ferramenta de "caixa preta" leve — perfeita para quando você não pode retreinar o modelo, mas não é um substituto para o treinamento completo quando você precisa de raciocínio profundo e complexo.

No fim, os autores mostram que um empurrão simples e independente de contexto pode extrair um pouco mais de desempenho de um modelo congelado. É um lembrete de que, às vezes, você não precisa reconstruir o motor para conseguir um pouco mais de velocidade; você só precisa saber quais botões apertar.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →