← Últimos artigos
🤖 machine learning

Rosetta Memory: Adaptive Memory for Cross-LLM Agents

O artigo apresenta o Rosetta Memory, um framework centrado em memória que emprega operadores condicionados a perfis e treinados conjuntamente e um currículo de amostragem de ganho mínimo para permitir o compartilhamento adaptativo de memória e um desempenho robusto através de diversos e frequentemente alternados modelos de linguagem de grande escala.

Autores originais: Hao Yang, Shiqi Shen, Haoxuan Li, Zhipeng Wang, Zhi Gong, Xu Chen

Publicado 2026-06-09
📖 4 min de leitura☕ Leitura rápida

Autores originais: Hao Yang, Shiqi Shen, Haoxuan Li, Zhipeng Wang, Zhi Gong, Xu Chen

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

O Grande Problema: O Agente "Perdido na Tradução"

Imagine que você tem uma equipe de trabalhadores (agentes de IA) tentando resolver um mistério complexo, como uma história de detetive. Para resolvê-lo, eles precisam passar bilhetes uns para os outros.

  • O Trabalhador A é um programador rápido e casual que escreve notas em tópicos rápidos e abreviados.
  • O Trabalhador B é um escritor lento e cuidadoso que precisa de frases completas e educadas para entender as coisas.
  • O Trabalhador C é um pensador visual que precisa de informações organizadas em uma tabela.

No passado, se o Trabalhador A escrevesse uma nota e a passasse para o Trabalhador B, o Trabalhador B frequentemente ficava confuso. A nota foi escrita na "linguagem do Trabalhador A", não na "linguagem do Trabalhador B". A equipe perdia o rastro das pistas, esquecia detalhes importantes ou entendia mal as instruções. É isso que acontece quando diferentes Modelos de Linguagem de Grande Escala (LLMs) tentam compartilhar memória: a "linguagem" da memória não coincide com a "linguagem" do leitor.

A Solução: Rosetta Memory (RoMem)

Os autores criaram um sistema chamado Rosetta Memory. Pense nele como um tradutor universal e um tabelião especializado para sua equipe de IA.

Em vez de forçar cada trabalhador a escrever da mesma forma, a Rosetta Memory senta-se no meio e adapta as notas com base em quem está escrevendo e quem está lendo.

Ela utiliza duas ferramentas especiais (operadores):

  1. O "Tradutor" (Operador de Escrita): Quando um trabalhador escreve uma nota, esta ferramenta observa quem a escreveu. Ela pega as notas brutas e bagunçadas e as reescreve em um formato "padronizado" que seja fácil para qualquer um entender mais tarde. Ela remove as peculiaridades pessoais do escritor.
  2. O "Adaptador" (Operador de Leitura): Quando um trabalhador precisa ler uma nota, esta ferramenta observa quem está lendo. Ela pega essa nota padronizada e a remodela no formato específico que esse leitor prefere (por exemplo, transformando um parágrafo em uma tabela para o pensador visual, ou em uma lista de tópicos para o programador).

Como Eles Ensinaram o Sistema

Para ensinar este sistema a trabalhar, os pesquisadores não mostraram apenas um tipo de trabalhador. Eles criaram um "campo de treinamento" com muitos tipos diferentes de modelos de IA (alguns rápidos, alguns lentos, alguns de empresas diferentes).

Eles usaram um truque de treinamento inteligente chamado "Amostragem de Ganho Mínimo" (Minimum-Gain Sampling).

  • Imagine um professor que percebe que o "escritor lento e cuidadoso" (Trabalhador B) é quem mais tem dificuldade para entender as notas.
  • Em vez de praticar com os alunos fáceis, o professor força o sistema a praticar extra arduamente com os alunos que estão enfrentando dificuldades.
  • Isso garante que o sistema se torne realmente bom em ajudar os modelos que costumam ser deixados para trás, em vez de apenas ser bom para o caso médio.

Eles também usaram uma "folha de pontuação" que só dava pontos se o sistema realmente melhorasse o desempenho da equipe em comparação com o simples ato de passar notas brutas. Isso garantiu que o sistema estivesse aprendendo a traduzir, e não apenas a memorizar respostas.

O Que Eles Descobriram

Os pesquisadores testaram isso em três diferentes "jogos de mistério" (datasets chamados HotpotQA, 2WikiMultihopQA e MuSiQue), onde a IA tinha que conectar múltiplas pistas para encontrar uma resposta.

  • O Resultado: Equipes usando a Rosetta Memory resolveram os mistérios muito melhor do que equipes usando métodos padrão.
  • O Teste do "Não Visto": Mesmo quando testaram o sistema com um novo tipo de trabalhador que eles nunca tinham visto durante o treinamento, ele ainda funcionou bem. O sistema não quebrou quando a composição da equipe mudou.
  • A Prova do "Descompasso": Eles mostraram que, sem este sistema, se você trocar os trabalhadores no meio de uma tarefa, a equipe geralmente falha porque as notas não fazem sentido para o novo trabalhador. Com a Rosetta Memory, as notas sempre fazem sentido, não importa quem esteja lendo.

Em Resumo

Rosetta Memory é um intermediário inteligente que garante que os agentes de IA possam trocar notas perfeitamente, mesmo que falem "línguas" ou tenham estilos diferentes. Ela traduz a memória quando ela é escrita e a adapta quando ela é lida, garantindo que toda a equipe permaneça na mesma página, independentemente de qual modelo de IA específico esteja realizando o trabalho em qualquer dado momento.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →