← Últimos artigos
💬 NLP

MemoHarness: Agent Harnesses That Learn from Experience

O MemoHarness é um framework de otimização de agentes adaptativo que aprimora o desempenho de LLMs em diversas tarefas ao decompor a camada de controle em seis dimensões e adaptar dinamicamente as configurações do harness para cada caso usando um banco de experiências de camada dupla derivado de execuções passadas, tudo sem exigir rótulos em tempo de teste ou busca adicional.

Autores originais: Yue Huang, Wenjie Wang, Han Bao, Yuchen Ma, Xiaonan Luo, Yi Nian, Haomin Zhuang, Zheyuan Liu, Yue Zhao, Xiangliang Zhang

Publicado 2026-07-17
📖 4 min de leitura☕ Leitura rápida

Autores originais: Yue Huang, Wenjie Wang, Han Bao, Yuchen Ma, Xiaonan Luo, Yi Nian, Haomin Zhuang, Zheyuan Liu, Yue Zhao, Xiangliang Zhang

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você tem um assistente robô brilhante e superinteligente. Você lhe dá uma tarefa e ele tenta resolvê-la. Mas aqui está o detalhe: o robô não precisa apenas ser inteligente; ele precisa saber como usar seu cérebro. Ele precisa de um conjunto de instruções sobre como organizar seus pensamentos, quando procurar informações, como pedir ajuda e como conferir seu trabalho antes de lhe dar a resposta. No mundo da inteligência artificial, esse conjunto de instruções e ferramentas é chamado de "agent harness" (harness de agente). Pense nisso como o painel, o volante e o GPS em um carro. O motor (o modelo de IA) pode ser potente, mas se o painel estiver quebrado ou o GPS estiver travado em um mapa antigo, o carro não vai levar você onde você precisa ir. Por muito tempo, cientistas tentaram tornar esses robôs mais inteligentes tornando os motores maiores. Mas este artigo faz uma pergunta diferente: e se apenas consertássemos o painel? E se pudéssemos ensinar o robô a aprender com seus próprios erros e ajustar seu estilo de condução para cada viagem individualmente, em vez de usar as mesmas instruções rígidas e padronizadas para tudo?

É exatamente isso que os pesquisadores por trás do MemoHarness se propuseram a fazer. Eles perceberam que a maioria dos agentes de IA hoje são como carros com um volante fixo: eles usam a mesma configuração para cada problema, seja uma curva simples ou uma fusão complexa em uma rodovia. A equipe construiu um novo sistema que atua como um "motorista aprendiz". Em vez de apenas procurar por um conjunto perfeito de instruções para usar para sempre, o MemoHarness permite que o agente aprenda com suas viagens passadas. Ele mantém um diário detalhado do que funcionou, do que falhou e do porquê. Quando uma nova tarefa surge, o agente não apenas adivinha; ele olha para seu diário, encontra situações passadas semelhantes e ajusta suas próprias instruções sobre a hora para se adequar ao desafio específico.

O artigo introduz uma maneira inteligente de decompor o "harness" em seis partes distintas, como ajustar diferentes botões em um painel de controle: como o agente coleta informações (Contexto), quais ferramentas ele usa (Ferramenta), como ele pensa e fala (Geração), a ordem de seus passos (Orquestração), o que ele lembra (Memória) e como ele finaliza sua resposta (Saída). Ao tratar esses elementos como superfícies separadas e editáveis, o sistema pode diagnosticar exatamente o que deu errado. Ele esqueceu de verificar um mapa? Tentou dirigir rápido demais? Esqueceu de lembrar um detalhe importante?

Em seus experimentos, a equipe testou este sistema em três tipos muito diferentes de tarefas: atuar como um terminal de computador para corrigir softwares, escrever código e resolver quebra-cabeças complexos de raciocínio financeiro. Os resultados foram promissores. Nos testes de terminal de computador, o MemoHarness melhorou a taxa de sucesso de 0,722 para 0,806, superando as melhores configurações fixas com as quais foi comparado. Também mostrou que esses hábitos aprendidos podiam se "transferir" para novas tarefas não vistas e até funcionar bem em diferentes tipos de modelos de IA sem a necessidade de serem retreinados. Por exemplo, quando pegaram o harness aprendido em um modelo e o aplicaram a outros seis modelos, a taxa de sucesso média saltou em +0,098.

Os autores sugerem que esta abordagem é uma maneira prática de tornar a IA mais adaptável sem precisar construir um novo motor toda vez. No entanto, eles são cuidadosos ao notar que, embora os resultados sejam fortes, eles se baseiam em testes e simulações específicas. Eles não afirmam ter resolvido todos os problemas ou provado que isso funciona perfeitamente em todos os cenários do mundo real. Eles também descobriram que, embora o sistema utilize mais dados para "ler" seu diário, a maior parte desses dados pode ser armazenada em cache (guardada para reutilização rápida), mantendo o custo competitivo. Em suma, o MemoHarness sugere que dar a uma IA a capacidade de refletir sobre sua própria experiência e ajustar seu próprio painel de controle pode ser a chave para torná-la verdadeiramente útil, transformando uma máquina rígida em um parceiro flexível e capaz de aprender.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →