← Últimos artigos
💬 NLP

Memory for Large Language Models

Este levantamento apresenta uma taxonomia sistemática e centrada na arquitetura para a memória em modelos de linguagem de grande escala, unificando pesquisas fragmentadas por meio de um framework de três eixos de representação, dinâmica de atualização e persistência para orientar o design escalável e adaptativo futuro.

Autores originais: Sining Zhoubian, Dan Zhang, Evgeny Kharlamov, Jie Tang

Publicado 2026-07-29
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Sining Zhoubian, Dan Zhang, Evgeny Kharlamov, Jie Tang

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você está ensinando a escrever uma história para um amigo brilhante, mas esquecido. Você se senta com ele, entrega uma biblioteca enorme de livros e ele memoriza tudo. É assim que os cérebros de computador mais avançados de hoje, chamados Modelos de Linguagem de Grande Escala (LLMs), funcionam. Eles são como estudantes superinteligentes que leram quase tudo na internet. Mas aqui está o detalhe: assim que terminam de ler um livro, eles geralmente esquecem os detalhes, a menos que você mantenha o livro aberto bem na frente deles. No mundo da IA, esse "livro aberto sobre a mesa" é chamado de memória.

Por muito tempo, esses modelos de IA tiveram um tipo de memória muito específico. Era como um post-it que só durava enquanto você estivesse olhando para ele. Se você tentasse ler um romance que fosse mais longo do que o post-it conseguia conter, a IA começaria a esquecer o início da história quando chegasse ao meio. Isso era chamado de "memória implícita" — era apenas um efeito colateral de como o computador estava fazendo sua matemática, não uma ferramenta dedicada para lembrar. Mas recentemente, cientistas começaram a fazer uma grande pergunta: E se déssemos a esses modelos de IA um caderno de verdade? Um lugar onde eles pudessem anotar fatos importantes, guardá-los para sempre e procurá-los mais tarde, exatamente como um ser humano faz? Essa mudança de "esquecer tudo depois que a conversa termina" para "ter um cérebro permanente e organizado" é a grande história que está acontecendo agora na ciência da computação.

Este artigo é um guia massivo para esse novo mundo. Os autores, uma equipe de pesquisadores, notaram que todos estão inventando maneiras diferentes de dar memória à IA, mas todos estão usando nomes diferentes e mapas confusos. Algumas pessoas estão construindo "post-its", outras estão construindo "arquivos de aço", e algumas estão até tentando ensinar a IA a reescrever seu próprio cérebro enquanto fala. O trabalho principal deste artigo é organizar todas essas ideias bagunçadas em um sistema limpo e organizado. Eles propõem uma nova maneira de olhar para a memória da IA usando três perguntas simples: O que está sendo armazenado? Quando ele é atualizado? e Quanto tempo ele dura?

O artigo sugere que estamos nos afastando da antiga maneira, onde a memória era apenas um subproduto temporário do pensamento, em direção a uma nova era onde a memória é uma ferramenta dedicada e controlável. Eles descobrem que existem dois tipos principais de memória agora. O primeiro é a Memória Implícita, que é como a memória de trabalho de curto prazo da IA. É rápida e flexível, mas está ligada à conversa imediata e desaparece no momento em que o chat termina. Pense na IA mantendo uma conversa em sua cabeça; ela pode lembrar o que você disse cinco segundos atrás, mas não consegue se lembrar do que você disse ontem, a menos que você a lembre.

O segundo tipo é a Memória Explícita, que é a parte emocionante e nova. Isso é como dar à IA um caderno de verdade ou um disco rígido digital. Esta memória é separada do processo de pensamento. A IA pode escrever um fato nesse caderno, fechar o chat e voltar dias depois para lê-lo. O artigo mostra que os pesquisadores estão construindo esses cadernos de diferentes maneiras: alguns são "parametrizados", o que significa que a IA aprende a escrever diretamente em seus próprios pesos cerebrais; outros são baseados em "busca", onde a IA pesquisa em um banco de dados gigante de fatos; e alguns são "mistura de especialistas", onde a IA tem diferentes especialistas que ela pode chamar para diferentes tópicos.

No entanto, o artigo é muito claro que isso ainda não é um problema resolvido. Embora esses novos sistemas de memória sejam poderosos, eles trazem grandes compensações. Os autores apontam que só porque você dá à IA um caderno maior, não significa que ela lembrará melhor. Às vezes, a IA fica confusa com excesso de informações, ou escreve coisas erradas e não consegue apagá-las. Eles também observam que atualizar essa memória enquanto a IA está falando (atualização "online") é arriscado e pode tornar a IA instável, enquanto atualizar apenas quando ela está aprendendo (atualização "offline") é mais seguro, porém menos flexível.

O artigo não afirma que construímos um cérebro perfeito e humano. Em vez disso, sugere que estamos em uma fase desordenada e experimental, na qual estamos tentando descobrir as melhores regras sobre como a IA deve armazenar e usar informações. Eles argumentam que o futuro não é escolher apenas um tipo de memória, mas sim construir sistemas híbridos. Imagine um modelo que tem um post-it rápido para a conversa atual, um caderno pessoal para fatos de longo prazo e um cartão de biblioteca para pesquisar na internet, todos trabalhando juntos. Os autores concluem que, para tornar a IA verdadeiramente inteligente e útil, precisamos parar de tratar a memória como um acidente e começar a projetá-la como um recurso central, equilibrando cuidadosamente quanto ela lembra, quão rápido ela atualiza e por quanto tempo ela mantém as coisas. É um roteiro para transformar um gênio esquecido em um companheiro verdadeiramente sábio.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →