← Últimos artigos
🤖 machine learning

Super Weights in LLMs and the Failure of Selective Training

Este artigo demonstra que o conceito de "Super Pesos" não se generaliza para todos os LLMs e que tentar treinar esses parâmetros críticos identificados individualmente de forma isolada causa uma falha catastrófica de desempenho, provando que o ajuste fino eficaz depende de decomposições estruturadas em nível de camada em vez de visar pesos específicos de alta importância.

Autores originais: Shreyas Subramanian, Adewale Akinfaderin, Akarsha Sehwag

Publicado 2026-07-10
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Shreyas Subramanian, Adewale Akinfaderin, Akarsha Sehwag

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você tem um cérebro de robô gigante e superinteligente (um Grande Modelo de Linguagem) que já aprendeu a ler, escrever e raciocinar. Recentemente, alguns cientistas descobriram alguns "botões mágicos" dentro desse cérebro. Eles os chamaram de Super Pesos (Super Weights).

A parte louca é: se você apenas deletar um desses botões mágicos, o cérebro do robô fica completamente descontrolado. O desempenho cai tanto que é como se ele tivesse esquecido como falar inteiramente. Foi tão chocante que todos assumiram que esses botões eram as partes mais importantes do cérebro.

Então, uma questão surgiu: Se esses botões são tão importantes, o que acontece se treinarmos apenas eles?

A ideia era: "Vamos congelar o resto do cérebro e deixar apenas os Super Pesos aprenderem coisas novas. Como eles são as 'estrelas', eles devem ser capazes de consertar os erros do robô por conta própria, certo?"

A resposta é um NÃO retumbante.

De fato, o artigo mostra que tentar treinar apenas esses Super Pesos é um desastre. É como tentar consertar o motor de um carro apenas girando o volante. Não importa o quanto você tente, o carro não vai se mover.

O Experimento dos "Botões Mágicos"

Os pesquisadores pegaram duas versões de um modelo chamado OLMo (uma com 1 bilhão de parâmetros e outra com 7 bilhões). Eles tentaram ensinar o modelo uma nova tarefa (responder perguntas de múltipla escolha) atualizando apenas os Super Pesos.

Eles testaram diferentes quantidades de botões:

  • Treinaram apenas 100 Super Pesos.
  • Tentaram 1.000.
  • Tentaram até 8.192 (que é 81 vezes mais do que a primeira tentativa).

O resultado? A precisão do modelo caiu para níveis de chute aleatório.

  • Para o modelo de 1 bilhão, ele acertou cerca de 25%, que é o que você consegue se apenas chutar cegamente em uma questão de 4 alternativas.
  • Para o modelo de 7 bilhões, também caiu para cerca de 25–26%.

Mesmo quando tentaram ser gentis e treinar os Super Pesos mais seus vizinhos imediatos (um pequeno "bairro" de cerca de 36.000 parâmetros), ainda falhou. O modelo simplesmente não conseguiu aprender.

A Reviravolta: "Não são os Botões, é a Estratégia"

Você pode pensar: "Ok, talvez o problema seja que eles estavam treinando um conjunto minúsculo e esparso de botões. Talvez se treinassem qualquer conjunto minúsculo, falharia."

O artigo diz: Não, não é isso também.

Para provar isso, os pesquisadores fizeram um teste de controle inteligente. Eles escolheram o mesmo número de botões (4.096), mas em vez de escolher os "Super", escolheram botões aleatórios da mesma parte do cérebro.

  • Resultado: O modelo na verdade ficou melhor! Ele marcou 64,18% (superando a linha de base de 60,65%).

Isso prova que a falha não foi porque eles estavam treinando poucos parâmetros. A falha foi especificamente porque eles estavam visando os Super Pesos. Essas coordenadas específicas estão quebradas para treinamento isolado.

Por que eles falham? A Analogia do Amplificador

Pense nos Super Pesos como grandes botões de volume em um sistema de som. Eles estão girados tão alto que amplificam o sinal de forma massiva.

  • Se você deletá-los: O sistema de som fica silencioso (o modelo quebra).
  • Se você tentar ajustá-los sozinhos: É um pesadelo. Porque eles já estão tão altos, até um pequeno ajuste envia o volume para a estratosfera, causando loops de feedback e distorção. O sistema torna-se instável e colapsa.

O artigo sugere que, quando você tenta treinar esses botões isoladamente, a matemática sai do controle. A "curvatura" (o quão íngreme é a colina de aprendizado) nesses pontos é tão grande que o otimizador (aquilo que faz o aprendizado) fica confuso e o modelo colapsa.

O Verdadeiro Herói: LoRA

Então, como realmente ensinamos essas coisas novas aos modelos sem quebrá-los? O artigo aponta para um método chamado LoRA (Low-Rank Adaptation).

Imagine o LoRA não como um mecânico tentando consertar parafusos individuais, mas como um maestro regendo uma orquestra.

  • Em vez de tocar nos botões dos Super Pesos diretamente, o LoRA adiciona uma camada de música pequena e estruturada antes que o som chegue aos botões.
  • Ele atualiza cada uma das posições nas camadas de atenção (a "orquestra") usando uma estrutura de baixo posto (low-rank), mas treina apenas cerca de 0,16% dos parâmetros totais.
  • O Resultado: O modelo aprende perfeitamente!
    • No modelo de 1 bilhão, atingiu 66,88% de precisão.
    • No modelo de 7 bilhões, atingiu 77,3% de precisão.

Mais legal ainda? Os pesquisadores tentaram "congelar" as partes do LoRA que correspondiam às localizações dos Super Pesos (para ver se aqueles pontos específicos eram o problema). Não importou. O modelo ainda funcionou muito bem. Isso prova que a estrutura da atualização (o maestro regendo toda a orquestra) é o que importa, não a localização específica dos botões.

E quanto à "Magia" do Artigo Original?

O artigo também verificou a descoberta original dos Super Pesos. O estudo anterior os encontrou olhando para apenas um exemplo. O novo artigo verificou 1.000 exemplos diferentes.

  • Eles descobriram que 9 botões específicos eram críticos em 100% dos casos.
  • Isso confirma que os Super Pesos são partes estruturais reais do cérebro, não apenas flutuações de um exemplo específico.

A Conclusão

O artigo entrega uma mensagem clara: Só porque uma parte do cérebro é importante, não significa que você possa treiná-la sozinha.

  • Deletar Super Pesos quebra o modelo.
  • Treinar Super Pesos sozinho quebra o modelo.
  • Treinar um conjunto aleatório de pequenas partes funciona razoavelmente.
  • Treinar todo o sistema com uma abordagem estruturada de baixo posto (LoRA) funciona melhor.

Acontece que a "magia" desses modelos não está em alguns botões especiais que você pode ajustar. Está no trabalho conjunto de toda a rede. Você não pode apenas remendar o motor girando um parafuso; você precisa sintonizar toda a máquina em harmonia.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →