← Últimos artigos
🤖 AI

Transformers converge to invariant algorithmic cores

Este artigo introduz a Extração de Núcleo Algorítmico (ACE) para demonstrar que transformers treinados de forma independente, apesar de variações nas configurações de pesos, convergem em subespaços algorítmicos compactos e invariantes que governam seu comportamento, revelando uma estrutura computacional compartilhada sob a complexidade aparente e oferecendo um novo caminho para a compreensão e o controle mecanísticos.

Autores originais: Joshua S. Schiffman

Publicado 2026-07-08
📖 6 min de leitura🧠 Leitura aprofundada

Autores originais: Joshua S. Schiffman

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

A Grande Ideia: Caminhos Diferentes, Mesmo Destino

Imagine que você está tentando ir da sua casa até uma cafeteria específica.

  • O Motorista A faz uma rota pelos subúrbios, depois uma rodovia, depois um beco sem saída.
  • O Motorista B faz uma rota pelo centro da cidade, depois um parque, depois uma ponte.
  • O Motorista C faz um caminho completamente diferente envolvendo uma balsa e um trem.

Se você olhar para os seus mapas (as estradas específicas que eles percorreram), eles não se parecem em nada. São totalmente diferentes. No entanto, se você observar o que eles estão realmente fazendo (o ato de dirigir até a cafeteria), todos estão fazendo exatamente a mesma coisa.

Este artigo argumenta que os modelos de IA (especificamente os "Transformers") funcionam da mesma forma. Quando treinamos dois modelos de IA para realizar a mesma tarefa, eles acabam com uma "fiação" interna (pesos e parâmetros) completamente diferente. Mas, no fundo, todos estão usando o mesmo "motor" oculto para realizar o trabalho.

Os autores chamam esse motor oculto de Núcleo Algorítmico (Algorithmic Core).

O Problema: Olhando para a Coisa Errada

Normalmente, quando cientistas tentam entender como a IA funciona, eles olham para a fiação específica de um único modelo. O artigo diz que isso é arriscado. É como estudar o mapa do Motorista A e pensar: "Ah, então para chegar ao café, você precisa pegar o beco". Mas isso foi apenas um acidente da rota do Motorista A. O Motorista B não passou por aquele beco.

O artigo sugere que devemos parar de olhar para as estradas específicas (os detalhes bagunçados e únicos de uma única execução de treinamento) e começar a procurar pelo Invariante (a verdade imutável que todos os motoristas compartilham).

A Solução: Encontrando o "Núcleo"

Os autores criaram uma ferramenta chamada ACE (Extração de Núcleo Algorítmico). Pense no ACE como um par especial de óculos de raio-X.

  1. Ele filtra o ruído: Ele ignora os milhões de detalhes únicos que tornam uma IA diferente da outra.
  2. Ele encontra o motor: Ele isola um "núcleo" minúsculo e compacto dentro da IA que é absolutamente necessário para realizar a tarefa. Se você remover este núcleo, a IA falha. Se você mantiver apenas este núcleo, a IA continua funcionando perfeitamente.
  3. Ele prova que são iguais: Mesmo que as IAs pareçam diferentes por fora, o ACE mostra que todas escondem o mesmo "motor" matemático dentro de si.

Três Experimentos: Do Simples ao Complexo

O artigo testou essa ideia em três cenários diferentes:

1. O Quebra-Cabeça Simples (Cadeias de Markov)
Eles ensinaram três IAs diferentes um jogo simples: prever o próximo passo em uma sequência.

  • Resultado: As três IAs aprenderam usando mapas internos completamente diferentes. Sua "fiação" era quase totalmente distinta.
  • O Núcleo: Mas quando o ACE olhou lá dentro, encontrou que todas as três escondiam um "núcleo" minúsculo de 3 dimensões que fazia exatamente a mesma matemática. Foi como descobrir que três carros diferentes usavam exatamente o mesmo arranjo de pistões de 3 cilindros, embora o restante dos carros parecesse diferente.

2. O Mistério do "Grokking" (Adição Modular)
"Grokking" é um fenômeno estranho onde uma IA passa subitamente de falhar em um problema matemático para resolvê-lo perfeitamente, muitas vezes após um longo tempo apenas memorizando respostas.

  • A Descoberta: Os autores descobriram que, no momento em que a IA "grok" (entende subitamente), um "núcleo" circular e compacto se forma dentro dela. Este núcleo age como um relógio, rotacionando números para resolver a matemática.
  • A Reviravolta: Se você continuar treinando a IA após ela ter aprendido, este núcleo fica "inchado". Ele começa a usar muito mais espaço do que o necessário, preenchendo-se com cópias redundantes da mesma matemática.
  • A Lição: O artigo descobriu que ter muitas formas redundantes de resolver um problema ajuda a IA a aprender mais rápido. É como ter uma equipe de pessoas todas gritando a mesma resposta; eventualmente, a resposta certa chega mais rápido.

3. O Mundo Real (Modelos de Linguagem)
Finalmente, eles observaram seis modelos de IA gigantescos do mundo real (como GPT-2, LLaMA e outros) que são usados para escrever textos. Esses modelos são enormes e muito diferentes entre si.

  • A Tarefa: Eles focaram na Concordância Sujeito-Verbo (saber se uma frase precisa de "é" ou "são").
  • A Descoberta: Em todos os seis modelos massivos, existe uma "linha" invisível (um eixo de 1 dimensão) no cérebro da IA que controla se uma frase é singular ou plural.
  • O Truque Mágico: Se você pegar essa única linha e "invertê-la" (reverter a direção), a IA instantaneamente começa a cometer erros gramaticais. Ela muda "O gato é" para "O gato são".
  • O Alinhamento: Embora esses modelos tenham sido construídos por empresas diferentes, treinados com dados diferentes e tenham tamanhos diferentes, todos usam essa mesma linha exata para lidar com a gramática. É como se cada cérebro humano, independentemente da cultura ou língua, usasse o exato mesmo interruptor neural para decidir entre "Eu" e "Nós".

Por Que Isso Importa

O artigo conclui que, sob a superfície bagunçada e complexa da IA, existe uma estrutura compartilhada e mais simples.

  • Não olhe para a pintura: As cores e formas específicas da IA (seus parâmetros) são apenas acidentes de como ela foi treinada.
  • Olhe para o motor: O "Núcleo Algorítmico" é o que importa. É a parte que permanece a mesma, não importa quem construa a IA ou como a construam.

Ao encontrar esses núcleos, podemos entender e controlar melhor a IA. Em vez de tentar consertar um milhão de fios minúsculos, podemos simplesmente encontrar o "interruptor" que controla o comportamento que nos interessa.

Analogia de Resumo

Imagine três arquitetos diferentes construindo uma casa.

  • O Arquiteto A usa madeira.
  • O Arquiteto B usa tijolo.
  • O Arquiteto C usa aço.

Se você olhar para os materiais, eles são totalmente diferentes. Mas, se você olhar para o projeto das escadas, poderá descobrir que todos os três arquitetos usaram exatamente o mesmo design de 10 degraus porque é a maneira mais eficiente de subir.

Este artigo diz: "Parem de discutir sobre a madeira, o tijolo e o aço. Vamos estudar as escadas."

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →