← Últimos artigos
🤖 AI

LCM: Lossless Context Management

Este artigo apresenta o Gerenciamento de Contexto sem Perdas (LCM), uma arquitetura determinística que aprimora a memória de LLMs por meio de compressão recursiva de contexto e particionamento de tarefas, permitindo que o agente Volt supere o Claude Code em tarefas de codificação de longo contexto de até 1 milhão de tokens, ao mesmo tempo que garante recuperação e término sem perdas do estado.

Autores originais: Clint Ehrlich, Theodore Blackman

Publicado 2026-05-07
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Clint Ehrlich, Theodore Blackman

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você está tentando resolver um mistério massivo, que dura vários dias. Você tem um detetive brilhante (a IA), mas ele possui uma memória de curto prazo muito limitada. Se você der a ele uma pilha de 1.000 pistas, ele esquecerá as primeiras antes de chegar às últimas.

Por muito tempo, a solução foi simplesmente dar ao detetive um caderno maior (uma "janela de contexto" maior). Mas, eventualmente, até os maiores cadernos ficam pesados demais para carregar, e o detetive começa a ficar confuso com o volume avassalador de papel.

Este artigo apresenta uma nova maneira de ajudar o detetive: Gerenciamento de Contexto sem Perdas (LCM). Pense nisso como dar ao detetive um bibliotecário superinteligente e automatizado que gerencia as anotações para ele, em vez de pedir que o detetive crie seu próprio sistema de arquivamento.

Veja como funciona, usando analogias simples:

1. O Problema: O Debate "GOTO" vs. "Estruturado"

O artigo compara duas maneiras de lidar com a memória:

  • O Jeito Antigo (RLM): Imagine pedir ao detetive para escrever seu próprio sistema de arquivamento em código. Ele precisa decidir como organizar as anotações, quando jogar coisas fora e como encontrá-las depois. Isso é como dar a um programador liberdade ilimitada para usar instruções GOTO (saltando para qualquer lugar no código). É poderoso, mas se o detetive cometer um erro em seu script de arquivamento, todo o sistema trava ou fica bagunçado.
  • O Jeito Novo (LCM): Em vez de pedir ao detetive para escrever o sistema de arquivamento, o motor (o computador que executa o detetive) fornece um arquivo pré-construído e perfeito. O detetive apenas diz: "Aqui está uma nova pista", e o motor decide automaticamente quando resumir pistas antigas e onde armazená-las. Isso é como usar programação estruturada (loops e instruções if): é menos flexível, mas nunca trava devido a lógica ruim.

2. As Duas Ferramentas Mágicas do LCM

O artigo afirma que o LCM usa dois truques principais para manter o detetive focado:

A. O Arquivo "Sem Perdas" (DAG Hierárquico)

  • Como funciona: O motor mantém uma "Cópia Mestre" de cada nota, palavra por palavra, em um cofre seguro (o Armazenamento Imutável).
  • O Resumo: Para economizar espaço no espaço de trabalho ativo do detetive, o motor cria um "cartão de resumo" para notas antigas. Ele coloca o cartão de resumo no espaço de trabalho e esconde a nota completa no cofre.
  • A Magia: Se o detetive precisar ver a nota original mais tarde, ele pode solicitá-la, e o motor troca instantaneamente o cartão de resumo pela nota completa. Nada é realmente perdido; é apenas comprimido até ser necessário.
  • Analogia: Imagine ler um livro de 500 páginas. Em vez de carregar o livro inteiro, você carrega um marcador com um resumo de uma frase de cada capítulo. Se precisar verificar um detalhe, você volta para a página específica do livro. Você nunca perde o texto original.

B. A Equipe "Paralela" (LLM-Map)

  • O Problema: Se o detetive tiver que ler 1.000 arquivos um por um, ele ficará cansado e esquecerá o primeiro arquivo antes de chegar ao último.
  • A Solução: Em vez de o detetive ler os arquivos pessoalmente, o motor age como um chefe que contrata 16 assistentes. O detetive dá ao chefe uma única instrução: "Leia esses 1.000 arquivos e me diga o ponto principal de cada um." O motor envia todos os 1.000 arquivos aos assistentes simultaneamente.
  • O Resultado: Os assistentes fazem o trabalho pesado em paralelo. O detetive só vê a lista final e organizada de resultados. O detetive nunca precisa segurar 1.000 arquivos em sua mente ao mesmo tempo.

3. A Promessa de "Custo Zero"

Uma das maiores alegações do artigo é que este sistema não desacelera as coisas para tarefas pequenas.

  • Analogia: Se você tiver apenas 5 notas para arquivar, o motor não se incomoda em criar um sistema de arquivamento complexo. Ele simplesmente deixa o detetive lê-las diretamente. O "arquivo" só entra em ação quando a pilha fica grande demais. Isso significa que, para conversas normais e curtas, o sistema parece tão rápido quanto uma IA padrão.

4. Os Resultados: Vencendo a Concorrência

Os autores testaram seu sistema (chamado Volt) contra o Claude Code, que atualmente é um dos melhores assistentes de codificação de IA do mundo.

  • O Teste: Eles deram a ambos os sistemas um "mistério" massivo com até 1 milhão de palavras de pistas (tokens).
  • O Resultado:
    • Para pistas pequenas (menos de 32.000 palavras), ambos os sistemas performaram de forma aproximadamente igual.
    • Para pistas enormes (32.000 a 1 milhão de palavras), o Volt venceu todas as vezes.
    • O artigo afirma que o Volt foi significativamente melhor em encontrar a resposta correta em conjuntos de dados massivos porque não ficou "confuso" com o volume de texto, enquanto o Claude Code começou a ter dificuldades conforme o texto ficava mais longo.

5. Por Que Isso Importa (De Acordo com o Artigo)

O artigo argumenta que pedir a uma IA para gerenciar sua própria memória (como no "Jeito Antigo") é arriscado porque a IA pode cometer erros em seu próprio código. Ao transferir o gerenciamento de memória para o motor do computador (o "Jeito Novo"), o sistema torna-se:

  1. Mais Confiável: Não trava porque a IA escreveu um script ruim.
  2. Mais Eficiente: Lida com quantidades enormes de dados sem que a IA fique sobrecarregada.
  3. Sem Perdas: Garante que nenhuma informação seja realmente excluída, apenas resumida.

Em resumo, o artigo sugere que, para tarefas muito longas e complexas, é melhor dar à IA um assistente estruturado e automatizado para lidar com a memória, em vez de deixar a IA tentar ser a bibliotecária ela mesma.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →