← Últimos artigos
💬 NLP

SlotGuard: Stop Oversharing Private Local Context in LLM Agent Transcri

O SlotGuard é um sistema local de fronteira de transcrição que impede de forma segura que agentes de LLM vazem contexto privado e credenciais ao reescrever dados sensíveis em slots sintéticos de preservação de formato vinculados via um grafo de sessão, alcançando assim vazamento zero de credenciais e sucesso de tarefa quase perfeito sem a fragilidade dos métodos de redação existentes.

Autores originais: Haocheng Xia, Yongjoo Park

Publicado 2026-07-21
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Haocheng Xia, Yongjoo Park

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine que você tenha um assistente robô superinteligente que pode fazer quase tudo por você: ele pode ler arquivos no seu computador, enviar e-mails, executar código e até conversar com outros softwares. Para realizar esses trabalhos, o robô precisa ver suas informações privadas, como seus caminhos de arquivos, seu endereço de e-mail e até senhas secretas. Mas há um porém: para descobrir o que fazer a seguir, o robô frequentemente precisa enviar um resumo de seu trabalho para um "cérebro" gigante baseado na nuvem (um modelo de linguagem de grande escala) pertencente a uma empresa de tecnologia. Esse resumo é chamado de "transcrição".

O problema é que essa transcrição é como uma entrada de diário que é enviada a um estranho. Se o robô acidentalmente escrever sua senha secreta ou seu endereço residencial no diário, a empresa de nuvem pode vê-los, armazená-los ou até mesmo usá-los para treinar seus futuros robôs. É como pedir a um amigo para ajudar você a assar um bolo, mas você tem que enviar uma foto da sua cozinha, e nessa foto a chave da sua casa está deitada bem ao lado da farinha. Você quer que seu amigo veja a cozinha para que ele possa lhe dizer como misturar a massa, mas você definitivamente não quer que ele veja sua chave. Este artigo aborda a questão complicada de como permitir que o robô veja seu mundo privado sem deixar que o céreão da nuvem espie seus segredos.

Apresentamos o SlotGuard, um novo sistema inteligente projetado para agir como um "segurança de privacidade" dentro do seu próprio computador. Pense no SlotGuard como um tradutor mágico que se senta entre o seu assistente robô e o cérebro da nuvem. Seu trabalho é reescrever o diário do robô antes que ele saia da sua casa. Em vez de deixar o robô escrever sua senha secreta real (como SuperSecret123!), o SlotGuard a substitui por um marcador de posição falso, mas perfeitamente moldado (como 🔑-SYNTHETIC-KEY-99).

Aqui está o truque de mágica: o marcador de posição falso parece e se sente exatamente como o real para o cérebro da nuvem. Se a senha real era uma longa sequência de letras e números, a falsa também é uma longa sequência de letras e números. Se o caminho do arquivo real era /Users/Alice/Secrets/Plan.pdf, o falso poderia parecer [REPO_ROOT_1]/Secrets/Plan.pdf. O cérebro da nuvem ainda consegue ler a estrutura — ele sabe que é um arquivo, sabe que é um segredo, e sabe como falar sobre isso — mas não tem ideia de qual é o segredo real. É como dar ao cérebro da nuvem um mapa onde o tesouro é marcado com um "X" genérico em vez das coordenadas reais.

Mas a mágica não para por aí. Quando o cérebro da nuvem envia instruções de volta, como "Vá abrir aquele arquivo", o SlotGuard intercepta a mensagem antes que ela chegue ao seu robô. Ele verifica sua própria lista secreta, vê que [REPO_ROOT_1] na verdade significa /Users/Alice/Secrets/Plan.pdf, e troca o falso pelo real apenas dentro do seu computador confiável. O robô então abre o arquivo real, e o cérebro da nuvem nunca soube que o nome real existia.

Os pesquisadores testaram este sistema com alguns deveres de casa sérios. Eles criaram milhares de cenários falsos onde robôs tentavam realizar tarefas envolvendo dados sensíveis, como ler documentos privados ou usar chaves secretas. Eles descobriram que, sem o SlotGuard, os robôs vazavam quase tudo — 100% das vezes. Mesmo métodos simples de "redação" (redaction), que apenas substituem segredos por palavras como [SENHA], foram um desastre; eles quebraram a capacidade do robô de realizar seu trabalho, fazendo-o falhar 97,5% das vezes porque o robô ficava confuso com a falta de detalhes.

O SlotGuard, no entanto, foi um divisor de águas. Em seus testes, a versão completa do sistema (que inclui um gráfico de rastreamento inteligente) escondeu com sucesso todas as credenciais plantadas e impediu todos os vazamentos de credenciais (0,0% de vazamento). Para dados estruturais como caminhos e e-mails, ele removeu 100% dos caracteres sensíveis visíveis, com exceção de um caso específico envolvendo caminhos absolutos de propriedade de root, que permanece como uma pequena lacuna no protótipo atual. Melhor ainda, ele não "quebrou o cérebro" do robô. Os robôs usando SlotGuard foram quase tão bons em seus trabalhos quanto se tivessem visto os segredos reais, mantendo suas taxas de sucesso altas em diferentes modelos. O sistema também é incrivelmente rápido, levando menos que um piscar de olhos (cerca de 14 microssegundos) para reescrever um único turno de conversa, de modo que não atrasa nada.

O artigo também aponta o que o SlotGuard não faz. Não é um escudo de leitura de mente; se o cérebro da nuvem for inteligente o suficiente para adivinhar seu segredo apenas pelo contexto da conversa, o SlotGuard não pode impedi-lo. Ele também não protege você se o seu próprio computador já estiver hackeado. Mas para o problema específico de manter seus dados privados longe de vazamentos nas transcrições da nuvem, o SlotGuard oferece uma solução robusta, rápida e inteligente que mantém seus segredos seguros enquanto permite que seu robô realize seu trabalho.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →