← Últimos artigos
🤖 machine learning

What's the plan? Metrics for implicit planning in LLMs and their application to rhyme generation and question answering

Este artigo apresenta técnicas simples e escaláveis para demonstrar que o planejamento implícito — um mecanismo no qual modelos de linguagem orientam tokens intermediários em direção a objetivos futuros, como rimas ou respostas — é uma capacidade universal presente até mesmo em modelos tão pequenos quanto 1 bilhão de parâmetros, oferecendo novos insights para segurança e controle de IA.

Autores originais: Jim Maar, Denis Paperno, Callum Stuart McDougall, Neel Nanda

Publicado 2026-05-12
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Jim Maar, Denis Paperno, Callum Stuart McDougall, Neel Nanda

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você está assistindo a um mágico tirar um coelho de um chapéu. Você pode se perguntar: O mágico realmente planejou tirar um coelho antes mesmo de começar o truque, ou ele apenas decidiu magicamente tirar um coelho no momento em que meteu a mão no chapéu?

Por muito tempo, os cientistas pensaram que os Modelos de Linguagem de Grande Porte (LLMs) — os cérebros de IA por trás de ferramentas como chatbots — eram como mágicos que não planejavam nada com antecedência. Eles acreditavam que a IA simplesmente previa a próxima palavra com base na anterior, como um papagaio repetindo sons, sem qualquer ideia de para onde a frase estava indo.

Este artigo, intitulado "Qual é o Plano?", argumenta que a IA é, na verdade, um arquiteto estratégico, e não apenas um papagaio. Ele mostra que esses modelos estão secretamente planejando seus movimentos futuros enquanto ainda estão falando.

Veja como os autores provaram isso, usando analogias simples:

1. Os Dois Tipos de Planejamento

Os autores definem o planejamento em duas partes, como um escritor compondo um poema:

  • Planejamento para Frente (O Projeto): Antes de escrever a segunda metade de uma frase, a IA cria um "projeto" oculto em seu cérebro. Ela sabe: "Preciso terminar esta linha com uma palavra que rime com 'gato'."
  • Planejamento para Trás (A Construção): À medida que escreve as palavras do meio da frase, ela as molda sutilmente para garantir que possa chegar suavemente a esse final em "gato". É como um motorista que vê uma curva se aproximando a 100 metros de distância e começa a frear e mudar de faixa agora, mesmo sem ter chegado à curva ainda.

2. O Experimento: Rimas e Perguntas

Para provar isso, os pesquisadores não pediram à IA que escrevesse um ensaio complexo. Eles deram a ela duas tarefas simples:

  • Rimas: Eles deram à IA a primeira linha de um poema e pediram que ela completasse a segunda linha com uma rima específica (por exemplo, se a primeira linha termina em "tijolo", a segunda deve terminar em "palito", "truque" ou "doente").
  • Resposta a Perguntas: Eles fizeram perguntas onde a resposta exigia uma regra gramatical específica, como escolher entre "um" e "uma" (por exemplo, "um baleia" vs. "uma olho").

3. O Truque do "Controle Remoto"

Esta é a parte mais legal do artigo. Os pesquisadores não apenas observaram a IA; eles hackearam seu cérebro no meio da frase.

Imagine que a IA está escrevendo um poema. Assim que ela termina a primeira linha, os pesquisadores usam um "controle remoto" (um vetor matemático) para empurrar o cérebro da IA.

  • O Empurrão: Eles disseram ao cérebro da IA: "Esqueça a rima em que você estava pensando. Agora, planeje a rima '-iz' (como luz ou paz)."
  • O Resultado: A IA não mudou apenas a última palavra. Ela reescreveu o meio da frase.
    • Sem o empurrão: "Sobrevoando onde a verdadeira alegria vai cantar."
    • Com o empurrão: "Sobrevoando banhado em uma luz dourada luz."

A IA mudou palavras como "onde a verdadeira alegria vai" para "banhado em uma dourada" porque precisava construir uma ponte para o novo destino ("luz"). Isso prova que a IA estava segurando um plano em sua cabeça o tempo todo e ajustou seu caminho para corresponder ao novo plano.

4. A Descoberta dos "Cérebros Pequenos"

Uma grande surpresa no artigo é que mesmo modelos de IA pequenos fazem isso.
Anteriormente, os cientistas pensavam que apenas modelos massivos e supercomplexos podiam planejar com antecedência. Os autores descobriram que até mesmo modelos com apenas 1 bilhão de parâmetros (que são relativamente pequenos no mundo da IA) estão fazendo esse planejamento. Não é apenas uma característica dos modelos "superinteligentes"; é um hábito básico de como esses modelos funcionam.

5. O Teste do "Artigo"

Eles também testaram isso com perguntas como "O que você usa para ver?" (Resposta: um olho).
Quando empurraram a IA para pensar em "coração" (que exige "um"), a IA imediatamente começou a usar "um" em vez de "uma" antes mesmo de escrever a palavra "coração".
Isso é como uma pessoa dizendo: "Quero comprar um..." e depois fazendo uma pausa para pensar em uma palavra começando com consoante, em vez de dizer "Quero comprar uma..." e depois perceber que cometeu um erro. A IA conhecia o destino antes de começar a jornada.

Resumo

O artigo afirma que:

  1. A IA planeja com antecedência: Ela cria um mapa oculto de para onde quer ir antes de chegar lá.
  2. Ela ajusta o caminho: Se você mudar o destino no meio da viagem, a IA muda os passos que dá para chegar lá, não apenas o passo final.
  3. Está em todo lugar: Isso acontece em modelos pequenos e grandes, em poesia e em perguntas simples.

Os autores não usaram isso para criar novos aplicativos ou corrigir problemas de segurança neste artigo específico; eles apenas queriam provar que a "magia" da IA não é apenas um chute aleatório — é uma forma de planejamento oculto e implícito.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →