← Últimos artigos
💻 computer science

Testing History Dependence Between In-Context and In-Weights Learning

Este estudo demonstra que, embora a ordem do treinamento (aproximar-se de uma mistura equilibrada a partir de diferentes direções) crie uma diferença transitória e mensurável na força dos mecanismos de aprendizado em contexto versus em pesos, isso não resulta em histerese persistente ou em organizações de circuitos causais fundamentalmente diferentes em pequenos transformers.

Autores originais: Zuo Yuchen

Publicado 2026-08-06
📖 4 min de leitura☕ Leitura rápida

Autores originais: Zuo Yuchen

Artigo original sob licença CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você está ensinando um robô a contar piadas. Você pode ensiná-lo de duas maneiras. Primeiro, você pode mostrar a ele alguns exemplos logo antes de ele falar, como uma folha de consulta sobre a mesa. O robô lê a folha de consulta e descobre o desfecho da piada com base no que ele vê agora mesmo. Isso é chamado de Aprendizado em Contexto (In-Context Learning). É como se o robô estivesse raciocinando rápido. Segundo, você pode praticar com o robô por horas até que ele memorize as piadas tão bem que não precise mais da folha de consulta. As piadas agora estão gravadas em seu cérebro. Isso é Aprendizado nos Pesos (In-Weights Learning).

Por muito tempo, os cientistas se perguntaram: se você der ao robô exatamente a mesma mistura de folhas de consulta e prática, ele sempre resolverá o problema da exata mesma maneira? Ou importa como ele chegou lá? Ele começou memorizando e depois aprendeu a ler a folha de consulta? Ou começou com a leitura da folha de consulta e depois memorizou as piadas? Essa questão é sobre dependência de histórico. No mundo da física, isso é semelhante à histerese — como um ímã que lembra para qual lado foi puxado, mesmo depois de você parar de puxar. Se o cérebro de um robô tem histerese, seu estado atual não depende apenas do que ele está vendo agora; é também sobre o caminho que ele percorreu para chegar ali. Isso importa porque, se os modelos de IA forem como isso, talvez não possamos prever seu comportamento apenas olhando para seus dados atuais; precisaríamos saber todo o seu histórico de treinamento.

Este artigo pega um robô pequeno e controlado (um modelo de IA minúsculo) e o submete a um teste específico para ver se ele possui esse tipo de "memória do caminho". Os pesquisadores criaram um jogo onde o robô tem que adivinhar um código secreto. Às vezes, o código depende de uma pista dada na frase atual (a folha de consulta) e, às vezes, depende de uma regra que o robô aprendeu há muito tempo (a memória gravada). Eles treinaram duas cópias idênticas do robô para alcançar exatamente o mesmo ponto no jogo, mas as levaram por rotas diferentes. Uma cópia começou focando nas regras gravadas e mudou lentamente para as folhas de consulta. A outra começou com as folhas de consulta e mudou lentamente para as regras gravadas.

Os pesquisadores descobriram que, quando ambos os robôs chegaram exatamente ao mesmo ponto, eles não agiram exatamente da mesma forma. Aquele que veio do lado das "regras gravadas" era ligeiramente mais propenso a usar a folha de consulta do que aquele que veio do lado da "folha de consulta". Era como se o robô que começou com as regras ainda estivesse um pouco "preso" naquela mentalidade, mesmo estando agora olhando para as mesmas pistas que o outro robô. Essa diferença era real e mensurável: a lacuna no comportamento deles era de cerca de 0,098 pontos em uma escala específica, e isso aconteceu em todos os cinco experimentos de treinamento diferentes.

No entanto, essa memória do caminho foi muito passageira. Os pesquisadores mantiveram os robôs treinando naquele mesmo ponto por mais um tempo. Após apenas 25 passos extras, a diferença começou a inverter e depois desapareceu. No momento em que completaram 100 passos, os dois robôs estavam agindo de forma quase idêntica. O "fantasma" do caminho que percorreram havia sumido.

Para entender por que isso aconteceu, os cientistas olharam dentro do cérebro do robô. Eles descobriram que ambos os robôs estavam usando exatamente as mesmas partes internas para resolver o problema. Eles não mudaram para um "circuito" diferente ou uma nova forma de pensar. Em vez disso, o robô que veio do lado das "regras gravadas" apenas aumentou ligeiramente o volume da parte de seu cérebro que lê a folha de consulta. Foi um aumento de volume temporário, não uma mudança permanente na fiação.

Assim, o artigo sugere que, embora os modelos de IA possam lembrar brevemente de como chegaram a um determinado ponto, isso não é um loop de "histerese" permanente onde ficam presos em estados diferentes para sempre. É mais como um atraso momentâneo, um excesso rápido que se estabiliza conforme o modelo continua aprendendo. O estudo mostra que, para entender verdadeiramente o comportamento de uma IA, você deve olhar para seu histórico imediato, mas não precisa se preocupar que ela ficará presa em um estado estranho para sempre apenas devido à forma como foi treinada. O modelo eventualmente alcança o nível e esquece o caminho, focando apenas no destino.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →