← Últimos artigos
🤖 machine learning

Towards Reliable, Generalizable, and Specific In-Context Knowledge Editing via Multi-Objective Reinforcement Learning

Este artigo propõe o Multi-Objective In-context Knowledge Editing (MO-IKE), um algoritmo de aprendizado por reforço multiobjetivo que formula a construção de prompts como um Processo de Decisão de Markov Restrito para otimizar simultaneamente confiabilidade, generalidade e especificidade, alcançando assim um desempenho superior na atualização de conhecimento de LLMs em comparação com métodos anteriores.

Autores originais: Xuzhong Wang, Maiqi Jiang, Tejal Nair, Girija Bhusal, Yanfu Zhang, Haipeng Chen

Publicado 2026-08-27
📖 4 min de leitura☕ Leitura rápida

Autores originais: Xuzhong Wang, Maiqi Jiang, Tejal Nair, Girija Bhusal, Yanfu Zhang, Haipeng Chen

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Os grandes modelos de linguagem são os motores por trás de uma nova geração de inteligência artificial, capazes de escrever histórias, resolver problemas e responder a perguntas com uma fluidez que frequentemente mimetiza o pensamento humano. No entanto, esses sistemas possuem uma limitação fundamental: seu conhecimento é congelado no tempo. Uma vez que um modelo conclui seu treinamento inicial, os fatos que ele detém tornam-se estáticos. Se um modelo foi treinado antes das Olimpíadas de Inverno de 2026, ele não saberá a contagem final de medalhas, não importa quantas vezes você pergunte. Atualizar esse conhecimento geralmente requer um processo de retreinamento massivo e caro, que é impraticável para a maioria dos usuários. Para resolver isso, pesquisadores desenvolveram uma técnica chamada edição de conhecimento em contexto (in-context knowledge editing). Em vez de alterar o código interno do modelo, este método fornece ao modelo um conjunto de exemplos no prompt da conversa, efetivamente ensinando-lhe um novo fato pela duração daquela interação específica. O desafio reside na construção do conjunto perfeito de exemplos: ele deve ser forte o suficiente para forçar o modelo a aceitar o novo fato, flexível o suficiente para funcionar mesmo se a pergunta for formulada de maneira diferente e preciso o suficiente para garantir que o modelo não acidentalmente esqueça ou altere fatos não relacionados que já conhece.

Uma equipe de pesquisadores introduziu agora um novo sistema chamado MO-IKE, que melhora significativamente como esses prompts são construídos. Tentativas anteriores de automatizar este processo baseavam-se em aprendizado por reforço, um método onde um programa de computador aprende por tentativa e erro. Embora esses sistemas anteriores pudessem ensinar com sucesso um novo fato ao modelo, eles frequentemente o faziam a um custo elevado. Em sua pressa para garantir que o novo fato fosse aceito, os sistemas removiam os exemplos necessários para proteger o conhecimento existente do modelo. Isso criava um equilíbrio frágil onde corrigir um erro fazia outros aparecerem. A nova abordagem trata a construção do prompt não como uma simples lista de itens, mas como um processo de tomada de decisão sequencial. O sistema aprende a escolher, um por um, se adiciona um exemplo que afirma o novo fato, um exemplo que refraseia a pergunta ou um exemplo que reforça um fato que deve permanecer inalterado. Ele para de adicionar exemplos apenas quando determina que o prompt está completo.

Os pesquisadores treinaram este sistema usando uma estrutura de recompensa multiobjetivo, o que significa que o computador foi recompensado pelo sucesso em três áreas simultaneamente: acertar o novo fato, lidar com diferentes formas de fazer a pergunta e manter seguros os fatos não relacionados. Ao equilibrar esses objetivos concorrentes, o novo método impede que o sistema se torne excessivamente agressivo em suas atualizações. Ao serem testados em um conjunto padrão de fatos, o novo sistema elevou a taxa de sucesso de edição de 87,1 por cento para 91,1 por cento. Mais importante ainda, ele melhorou dramaticamente a preservação do conhecimento não relacionado, elevando a taxa de retenção de 41,0 por cento para 63,4 por cento. Isso significa que o modelo agora é muito menos propenso a "esquecer" fatos que não precisavam ser alterados enquanto aprendia os novos. O sistema também provou ser altamente adaptável; uma versão treinada em um modelo de linguagem específico funcionou tão bem quando aplicada a um modelo completamente diferente sem qualquer treinamento adicional.

O estudo demonstra que a maneira como os exemplos são organizados importa tanto quanto os próprios exemplos. Métodos anteriores frequentemente usavam um template fixo ou focavam apenas em um único tipo de exemplo, o que levava a prompts desequilibrados. O novo sistema mistura dinamicamente diferentes tipos de exemplos, criando um contexto que é robusto e específico. Em testes em cinco modelos de linguagem congelados diferentes e quatro conjuntos de dados diferentes, incluindo um benchmark massivo com mais de 300.000 exemplos, o método superou consistentemente as técnicas anteriores. Os pesquisadores descobriram que, ao gerenciar cuidadosamente o equilíbrio entre ensinar novas informações e proteger as informações antigas, eles poderiam alcançar um nível de confiabilidade e especificidade que era anteriormente inalcançável. Este trabalho sugere que o futuro de atualizar a inteligência artificial pode não residir em um retreinamento massivo, mas em maneiras mais inteligentes e equilibradas de guiar o modelo através da conversa.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →