← Últimos artigos
🤖 machine learning

AlgoTrace: Algorithmic Primitives and Compositional Geometry of Reasoning in Language Models

O artigo apresenta o AlgoTrace, um framework que identifica e manipula primitivas algorítmicas reutilizáveis dentro do espaço latente de grandes modelos de linguagem, demonstrando que o raciocínio de múltiplas etapas pode ser direcionado e composto através de operações geométricas nesses vetores para aumentar a generalização entre tarefas.

Autores originais: Samuel Lippl, Thomas McGee, Kimberly Lopez, Ziwen Pan, Pierce Zhang, Salma Ziadi, Oliver Eberle, Ida Momennejad

Publicado 2026-08-27
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Samuel Lippl, Thomas McGee, Kimberly Lopez, Ziwen Pan, Pierce Zhang, Salma Ziadi, Oliver Eberle, Ida Momennejad

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Os modelos de linguagem de grande escala são os motores por trás da inteligência artificial moderna, capazes de escrever histórias, resolver equações e navegar por complexos quebra-cabeças de lógica. Durante anos, cientistas se perguntaram como esses sistemas realmente pensam. Eles simplesmente memorizam padrões de seus dados de treinamento ou realizam um raciocínio genuíno, passo a passo? Para responder a isso, pesquisadores começaram a olhar para dentro dos modelos, não para as palavras que eles produzem, mas para os sinais matemáticos invisíveis que fluem através de suas camadas internas enquanto trabalham. Esses sinais, frequentemente chamados de ativações latentes, são a matéria-prima do pensamento dentro da máquina. A questão era se esses sinais formam um mapa estruturado onde tipos específicos de pensamento acontecem em lugares específicos, de forma muito semelhante a como diferentes partes do céreão humano se especializam em diferentes tarefas. Se tal mapa existisse, significaria que o raciocínio não é um borrão caótico, mas uma jornada através de um cenário de ferramentas mentais distintas e reutilizáveis.

Uma equipe de pesquisadores mapeou agora esse cenário, revelando que os modelos de linguagem de grande escala dependem, de fato, de um conjunto de blocos de construção básicos e reutilizáveis para resolver problemas. Eles chamam esses blocos de construção de "primitivas algorítmicas". Pense em uma primitiva como um passo único e fundamental em um processo maior, como encontrar a cidade mais próxima de sua localização atual ao planejar uma viagem, ou verificar se uma equação matemática está equilibrada. Os pesquisadores desenvolveram um novo método para rastrear esses passos conforme eles ocorrem dentro do modelo. Ao observar como os sinais internos do modelo mudam enquanto ele resolve problemas difíceis, eles foram capazes de agrupar momentos de pensamento semelhantes. Eles descobriram que, quando o modelo está resolvendo um quebra-cabeça complexo, ele percorre uma sequência desses estados mentais distintos, tal como um viajante movendo-se de uma cidade para a próxima em um mapa.

Para entender o que estava acontecendo, a equipe testou os modelos em quatro tipos de desafios muito diferentes: encontrar a rota mais curta para um vendedor viajante visitando várias cidades, resolver quebra-cabeças de lógica com afirmações verdadeiras e falsas, enfrentar problemas difíceis de competições matemáticas e navegar por um labirinto virtual. Enquanto os modelos trabalhavam nessas tarefas, os pesquisadores registraram os sinais internos em cada etapa. Eles usaram um programa de computador para agrupar esses sinais em clusters, descobrindo que certos grupos de sinais apareciam consistentemente quando o modelo estava fazendo coisas específicas, como calcular uma distância ou verificar uma solução. Eles então usaram um sistema automatizado para ler o texto que o modelo estava escrevendo naqueles exatos momentos, confirmando que os sinais internos correspondiam às ações externas. Por exemplo, um cluster de sinais sempre aparecia quando o modelo estava escolhendo a cidade mais próxima para visitar em seguida, enquanto outro aparecia quando ele estava conferindo seu trabalho.

A descoberta mais significativa foi que esses blocos de construção mentais não são apenas marcadores passivos; eles podem ser ativamente controlados. Os pesquisadores extraíram um "vetor" específico, que é essencialmente uma direção no espaço interno do modelo, para cada uma dessas primitivas. Eles então injetaram esses vetores de volta no modelo enquanto ele estava pensando. Quando adicionaram o vetor de "encontrar o vizinho mais próximo", o modelo imediatamente começou a usar essa estratégia com mais frequência, mesmo que não fosse a melhor abordagem para o problema específico. Quando adicionaram o vetor de "gerar um novo caminho", o modelo começou a explorar mais opções. Isso provou que esses sinais internos são a causa direta do comportamento do modelo. Ao ligar ou desligar um interruptor mental específico, os pesquisadores puderam direcionar o modelo para pensar de forma diferente, sugerindo que o raciocínio do modelo é composto por essas partes distintas e manipuláveis.

O estudo também mostrou que esses blocos de construção podem ser combinados. Assim como você pode misturar cores primárias para criar novos tons, os pesquisadores descobriram que adicionar dois vetores de primitivas diferentes criava um novo comportamento combinado. Por exemplo, eles puderam pegar um vetor que ajudava o modelo a encontrar o fim de um caminho e outro que o ajudava a comparar valores, misturá-los, e o modelo subitamente tornou-se capaz de uma tarefa mais complexa que exigia ambas as habilidades. Isso sugere que a capacidade de raciocínio do modelo não é uma habilidade única e monolítica, mas uma geometria flexível onde operações simples podem ser montadas em soluções complexas.

Além disso, os pesquisadores compararam um modelo padrão com um que foi especialmente treinado para raciocinar melhor. Eles descobriram que o modelo treinado utiliza esses blocos de construção de forma mais eficaz. Ele depende menos de suposições por força bruta e mais de etapas estruturadas como verificação e planejamento. O modelo treinado também mostrou uma maior capacidade de transferir essas habilidades de um tipo de problema para outro. Uma ferramenta mental aprendida ao resolver um problema matemático poderia ser usada com sucesso para ajudar a resolver um quebra-cabeça de navegação. Isso indica que o processo de treinamento não apenas ensinou mais fatos ao modelo, mas na verdade fortaleceu sua capacidade de compor e reutilizar esses passos fundamentais de raciocínio em diferentes domínios.

As descobertas oferecem uma nova maneira de olhar para a inteligência artificial. Em vez de visualizar esses modelos como caixas pretas que produzem respostas por mágica, agora podemos vê-los como sistemas que percorrem um espaço estruturado de etapas algorítmicas. Os pesquisadores demonstraram que, ao compreender a geometria desses passos, podemos não apenas explicar por que um modelo comete um erro, mas também corrigi-lo ajustando os sinais internos. Este trabalho sugere que o caminho para uma inteligência artificial mais confiável e capaz reside em ensinar esses sistemas a compor e generalizar melhor esses blocos de construção básicos, permitindo que resolvam problemas que nunca viram antes ao combinar as ferramentas que já possuem.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →