Shattered Compositionality: Counterintuitive Learning Dynamics of Transformers for Arithmetic
Este artigo revela que os transformers aprendem habilidades aritméticas por meio de uma "componibilidade fragmentada" não humana e impulsionada por correlação, em vez de regras procedimentais sequenciais, levando a erros de mistura característicos e baixa robustez que persistem apesar do escalonamento do modelo ou da supervisão por scratchpad.
Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo
Imagine que você está ensinando um robô a resolver um quebra-cabeça. No mundo da inteligência artificial, esses robôs são chamados de "Grandes Modelos de Linguagem" (LLMs). Eles são como alunos extremamente entusiasmados que leram quase todos os livros da biblioteca. Eles são famosos por serem capazes de escrever histórias, depurar código e até resolver problemas matemáticos que parecem pertencer a um livro didático do ensino médio. Mas aqui está o problema: só porque um aluno consegue tirar um "A" em um teste prático não significa que ele realmente entenda as regras do jogo. Se você mudar o teste apenas um pouquinho — talvez adicionando um número extra ou rearranjando as palavras — o aluno pode subitamente entrar em pânico e falhar de maneiras estranhas e imprevisíveis. Os cientistas chamam isso de "fragilidade" (brittleness). É como uma casa de cartas que parece perfeita até que uma brisa suave sopra através dela.
Para entender por que isso acontece, os pesquisadores observam como esses modelos "aprendem" novas habilidades. Normalmente, esperamos que eles aprendam como os humanos: passo a passo, construindo uma base sólida antes de passar para o próximo nível. Por exemplo, ao aprender a somar números, um humano aprende a começar pelo fim (a casa das unidades), lidar com qualquer "transporte" (onde um número fica grande demais para um único lugar) e então seguir para as dezenas, centenas e assim por diante. Esta é uma forma de pensar lógica e hierárquica. Mas e se o robô aprender as regras em uma ordem completamente diferente? E se ele aprender os números grandes e assustadores primeiro e os pequenos depois, ou tentar aprender tudo de uma vez? Este artigo mergulha nesse mistério, usando quebra-cabeças matemáticos simples para observar como esses cérebros digitais realmente desenvolvem suas habilidades, revelando que eles podem estar pegando um atalho que parece aprendizado, mas não é exatamente o mesmo que a compreensão humana.
O Quebra-Cabeça Estilhaçado: Como a IA Aprende Matemática de Trás para Frente
Neste estudo, pesquisadores da Universidade de Wisconsin–Madison decidiram parar de adivinhar e começar a observar. Eles treinaram modelos de IA pequenos e simples (chamados de transformers) em tarefas aritméticas sintéticas — basicamente, fazendo-os praticar a adição e a multiplicação de números repetidamente. Mas, em vez de apenas verificar se eles obtinham a resposta correta ao final, eles observaram o processo de aprendizagem em câmera lenta, dígito por dígito. Eles queriam ver como os modelos descobriam as regras.
O que descobriram foi algo parecido com observar uma criança tentando calçar um par de sapatos começando pelos cadarços e depois tentando descobrir onde ficam os dedos dos pés. Os pesquisadores descobriram que esses modelos de IA não aprendem matemática da mesma forma que os humanos. Em vez de começarem pela base (a casa das unidades) e trabalharem seu caminho para cima, os modelos frequentemente aprendiam os dígitos mais altos primeiro.
Imagine que você está somando quatro números grandes. Um humano olharia para a coluna das unidades, somaria tudo, levaria o excesso para a coluna das dezenas e assim por diante. A IA, no entanto, parecia ignorar a coluna das unidades inteiramente no início. Ela focava nos lugares de milhares e centenas, aprendendo esses dígitos perfeitamente enquanto a casa das unidades permanecia uma bagunça. Era como se o modelo estivesse tentando adivinhar o tamanho total da pilha antes mesmo de saber quantos itens individuais havia nela. Os pesquisadores chamam esse fenômeno de "componibilidade estilhaçada" (shattered compositionality). Significa que o modelo está tentando construir uma casa de cartas, mas está empilhando o telhado no chão e esperando que a fundação o alcance mais tarde.
O Atalho da "Correlação"
Por que uma IA superinteligente faria algo tão bobo? O artigo sugere que a resposta reside em como a IA observa seus dados de treinamento. Humanos aprendem matemática entendendo a causa e o efefeito: "Se eu somar esses dois números um, eu obtenho um dez, então devo transportar um". A IA, no entanto, parece estar jogando um jogo de "correspondência estatística". Ela olha para os dados e pergunta: "Quais números costumam aparecer juntos?".
Os pesquisadores descobriram que os dígitos mais altos na resposta estão frequentemente fortemente ligados aos dígitos mais altos nos números de entrada, independentemente do que acontece nos dígitos inferiores. É um padrão forte e fácil de identificar. A IA se agarra a esse padrão fácil primeiro porque é o sinal mais óbvio nos dados. É como um detetive que vê o carro de um suspeito e imediatamente assume que ele é culpado porque tem um carro vermelho, ignorando todas as outras pistas. A IA aprende a regra do "carro vermelho" (os dígitos altos) primeiro porque é a correlação mais fácil de encontrar. Somente mais tarde, depois de dominar os dígitos altos, é que ela tenta descobrir as regras complicadas e bagunçadas para os dígitos inferiores.
Para provar isso, os pesquisadores realizaram um experimento de "sabotagem". Eles pegaram os dados de treinamento e embaralharam os dígitos da casa dos milhares, tornando-os aleatórios. De repente, a IA não conseguiu aprender os dígitos inferiores de jeito nenhum. Ela ficou travada. Isso provou que a IA não estava aprendendo as regras matemáticas em uma ordem lógica; ela estava contando com os dígitos altos para desbloquear o resto do quebra-cabeça. Sem os dígitos altos, todo o processo de aprendizagem colapsou.
O Caos do Aprendizado Paralelo
O problema fica ainda mais confuso quando a IA tenta aprender múltiplas habilidades ao mesmo tempo. Em tarefas como ordenar números ou compará-los, a IA tenta aprender diferentes regras em paralelo. É como um aluno tentando aprender a andar de bicicleta, fazer malabarismo e tocar piano ao mesmo tempo. Às vezes, essas habilidades atrapalham umas às outras.
Os pesquisadores descobriram que, quando a IA aprende essas habilidades simultaneamente, ela cria "erros de mistura". Imagine que você está organizando uma lista de nomes. Um humano verificaria primeiro o comprimento do nome, depois a primeira letra, depois a segunda. A IA, no entanto, pode se confundir. Ela pode pegar a primeira letra de um nome e a última letra de outro, costurando-as em uma palavra nova e sem sentido. O artigo chama isso de "erros de mistura". É como se a IA fosse um chef que aprendeu a picar cebolas e cortar cenouras separadamente, mas, quando solicitado a fazer uma salada, acidentalmente joga a cebola na tigela da cenoura e a cenoura na tigela da cebola, criando uma mistura estranha e inedível.
Esse aprendizado paralelo cria um sistema frágil. Se você pedir à IA para resolver um problema que seja ligeiramente diferente do que ela viu no treinamento — como adicionar um número a mais na lista — ela frequentemente desmorona. As habilidades que ela aprendeu em paralelo começam a brigar entre si, e o modelo produz respostas que são apenas uma mistura confusa das entradas.
O Tamanho ou a Inteligência Resolvem Isso?
Você pode pensar: "Ok, talvez os modelos pequenos estejam apenas confusos. E quanto aos modelos gigantes e superpoderosos que vemos nas notícias? Ou e se dermos a eles um 'bloco de notas' para escreverem seus pensamentos, como um humano faria?".
Os pesquisadores testaram isso também. Eles treinaram modelos muito maiores (até 100 milhões de parâmetros) e até fizeram o ajuste fino (fine-tuning) de um modelo pré-treinado massivo (Pythia-1B) nessas tarefas matemáticas. Eles também tentaram dar aos modelos um "bloco de notas" (scratchpad) onde pudessem escrever as etapas do problema matemático antes de dar a resposta final.
O resultado? Nada mudou.
Mesmo os modelos gigantes aprenderam os dígitos na ordem errada. Mesmo os modelos com blocos de notas ainda priorizavam os dígitos altos primeiro e tinham dificuldades com os baixos. Os blocos de notas ajudaram os modelos a obter a resposta correta mais rápido, mas não corrigiram o estilo de aprendizado subjacente. Os modelos ainda estavam pegando o "atalho da correlação" em vez de aprender a verdadeira lógica passo a passo da matemática. Isso sugere que simplesmente tornar a IA maior ou dar-lhe mais ferramentas não a faz automaticamente pensar como um humano. A "componibilidade estilhaçada" parece ser uma característica fundamental de como esses modelos aprendem a partir dos dados, não apenas um erro em um modelo pequeno específico.
A Conclusão
Este artigo pinta um quadro de uma IA que é incrivelmente capaz, mas fundamentalmente diferente de nós. Ela pode resolver problemas que parecem matemática humana, mas está fazendo isso com um conjunto diferente de regras internas. Ela não está seguando um algoritmo lógico e passo a passo; ela está seguindo um mapa de padrões estatísticos. Quando esses padrões são perfeitos, a IA brilha. Mas quando os padrões mudam apenas um pouco — quando o problema é ligeiramente diferente ou os dados estão bagunçados — o estilo de aprendizado "estilhaçado" da IA faz com que ela tropece.
Os pesquisadores não estão dizendo que a IA está quebrada ou é inútil. Eles estão dizendo que precisamos entender como ela aprende para confiar melhor nela. Se quisermos que a IA seja confiável no mundo real, onde os problemas raramente são perfeitos e os dados estão sempre mudando, precisamos descobrir como ensiná-la a construir suas habilidades em uma hierarquia estável e semelhante à humana, em vez de deixá-la aprender em uma pressa paralela e caótica. Até lá, teremos que ter cuidado ao pedir que esses alunos digitais resolvam um problema que seja apenas um pouco diferente daqueles em que praticaram.
Afogado em artigos na sua área?
Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.