← Últimos artigos
💬 NLP

Induction in Both Directions: A Mechanistic Analysis of In-Context Learning in Masked Diffusion Language Models

Este artigo fornece uma análise mecanística de modelos de linguagem de difusão (DLMs) mascarados, revelando que eles implementam um circuito de indução bidirecional simétrico em direção para o aprendizado em contexto e computam implicitamente frações de mascaramento global como passos de tempo, embora apenas superem modelos autorregressivos quando aproveitam o contexto bidirecional completo.

Autores originais: Andy Catruna, Emilian Radoi

Publicado 2026-07-20
📖 4 min de leitura☕ Leitura rápida

Autores originais: Andy Catruna, Emilian Radoi

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você está tentando ensinar um robô a terminar uma frase. Durante anos, a melhor maneira de fazer isso era fazer o robô ler uma história da esquerda para a direita, palavra por palavra, adivinhando a próxima com base apenas no que ele já tinha visto. É assim que a maioria dos escritores de IA modernos trabalha; eles são como uma pessoa lendo um livro que só consegue ver as páginas que já virou. Mas recentemente, cientistas começaram a construir um tipo diferente de robô. Em vez de ler da esquerda para a direita, este novo robô vê uma página inteira de texto onde algumas palavras estão escondidas atrás de caixas pretas. Ele olha para as palavras visíveis tanto à esquerda quanto à direita, adivinha o que está dentro da caixa, preenche-a e, em seguida, repete o processo até que a página inteira esteja clara. Isso é chamado de modelo de "difusão".

A grande questão para os cientistas é: Como esse novo robô aprende? Quando você mostra a um robô um padrão, como "O gato sentou no [BLANK]", e ele descobre que o espaço em branco deve ser "tapete", chamamos isso de "indução". É a maneira do robô dizer: "Eu já vi isso antes, então sei o que vem a seguir". Sabemos exatamente como os antigos robôs da esquerda para a direita fazem esse truque, mas não temos ideia de como os novos robôs do "olhar-para-tudo" conseguem realizá-lo. Eles usam os mesmos circuitos cerebrais? Eles têm um superpoder secreto por conseguirem ver os dois lados da palavra ausente? Compreender isso é crucial porque, se quisermos construir IAs melhores, precisamos saber como essas diferentes máquinas realmente pensam, não apenas o que elas dizem.


Neste artigo, os pesquisadores decidiram brincar de detetive com dois robôs muito semelhantes para ver como eles resolvem o mesmo quebra-cabeça. Eles construíram um robô padrão "da esquerda para a direita" e um novo robô "olhar-para-tudo", garantindo que fossem gêmeos em todos os aspectos, exceto na forma como leem. Deram a eles um jogo simples: encontrar um padrão repetido em uma longa sequência de letras aleatórias e copiar a letra faltante do local correspondente.

A equipe descobriu que o novo robô não apenas copia os truques do antigo; ele aprende um novo superpoder de duas vias. Enquanto o robô antigo só pode olhar para trás para encontrar sua resposta, o novo robô constrói um "circuito de indução" que funciona em ambas as direções. É como se o robô tivesse dois pequenos ajudantes: um que sussurra o que estava logo à esquerda da palavra ausente, e outro que sussurra o que estava logo à direita. Esses ajudantes escrevem essas pistas na memória do robô. Então, uma terceira parte "detetive" do robô usa essas pistas para escanear todo o texto — tanto o passado quanto o futuro — para encontrar o padrão correspondente e copiar a resposta.

Aqui está a reviravolta: o novo robô só é melhor que o antigo quando tem permissão para espiar os dois lados da palavra ausente. Se você bloquear sua visão do futuro e forçá-lo a olhar apenas para o passado (exatamente como o robô antigo), ele terá o mesmo desempenho. Isso prova que o novo robô não é apenas uma versão mais "inteligente" do antigo; sua vantagem vem inteiramente de sua capacidade de ver os dois lados da lacuna ao mesmo tempo.

Os pesquisadores também descobriram algo surpreendente sobre como o robô sabe quando adivinhar. Normalmente, esses robôs são informados exatamente em qual etapa do jogo de adivinhação eles estão (como "Etapa 1 de 100"). Mas esses robôs não receberam essa informação. Em vez disso, o artigo mostra que o robô conta secretamente quantas caixas pretas ainda restam na página. Ele usa essa contagem como um cronômetro oculto. Se houver muitas caixas restantes, ele age de uma forma; se houver poucas, ele age de outra. Os cientistas provaram isso cutucando o cérebro do robô e mostrando que mudar essa "contagem de caixas" altera diretamente a confiança do robô em seus palpites.

Em resumo, o artigo revela que esses novos robôs de difusão não apenas pensam de forma diferente; eles pensam em uma rua de mão dupla e simétrica. Eles reúnem pistas de ambos os lados, combinam-nas e até mantêm uma contagem mental secreta de quanto trabalho resta a fazer, tudo sem serem explicitamente instruídos a fazê-lo. Isso nos dá um mapa mais claro de como essas poderosas novas ferramentas estão aprendendo a entender o mundo.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →