← Últimos artículos
💬 NLP

SlotGuard: Stop Oversharing Private Local Context in LLM Agent Transcri

SlotGuard es un sistema de límites de transcripción local que evita de forma segura que los agentes de LLM filtren contexto privado y credenciales mediante la reescritura de datos sensibles en ranuras sintéticas de formato preservado vinculadas a través de un grafo de sesión, logrando así una filtración de credenciales nula y un éxito de tareas casi perfecto sin la fragilidad de los métodos de redacción existentes.

Autores originales: Haocheng Xia, Yongjoo Park

Publicado 2026-07-21
📖 5 min de lectura🧠 Análisis profundo

Autores originales: Haocheng Xia, Yongjoo Park

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina que tienes un asistente robot superinteligente que puede hacer casi cualquier cosa por ti: puede leer archivos en tu computadora, enviar correos electrónicos, ejecutar código e incluso hablar con otros programas. Para realizar estas tareas, el robot necesita ver tu información privada, como tus rutas de archivos, tu dirección de correo electrónico e incluso tus contraseñas secretas. Pero aquí está el truco: para determinar qué hacer a continuación, el robot a menudo tiene que enviar un resumen de su trabajo a un "cerebro" gigante basado en la nube (un modelo de lenguaje grande) propiedad de una empresa tecnológica. Este resumen se llama "transcripción".

El problema es que esta transcripción es como una entrada de diario que se le envía a un extraño. Si el robot accidentalmente escribe tu contraseña secreta o tu dirección particular en ese diario, la empresa de la nube podría verla, almacenarla o incluso usarla para entrenar a sus futuros robots. Es como pedirle ayuda a un amigo para hornear un pastel, pero tienes que enviarle una foto de tu cocina, y en esa foto, la llave de tu casa está justo al lado de la harina. Quieres que tu amigo vea la cocina para que pueda decirte cómo mezclar la masa, pero definitivamente no quieres que vea tu llave. Este artículo aborda la complicada cuestión de cómo permitir que el robot vea tu mundo privado sin dejar que el cerebro en la nube eche un vistazo a tus secretos.

Entra en escena SlotGuard, un nuevo y astuto sistema diseñado para actuar como un "portero de la privacidad" directamente dentro de tu computadora. Piensa en SlotGuard como un traductor mágico que se sienta entre tu asistente robot y el cerebro en la nube. Su trabajo es reescribir el diario del robot antes de que salga de tu casa. En lugar de dejar que el robot escriba tu contraseña secreta real (como SuperSecret123!), SlotGuard la cambia por un marcador de posición falso, pero perfectamente formado (como 🔑-SYNTHETIC-KEY-99).

Aquí está el truco de magia: el marcador de posición falso se ve y se siente exactamente igual que el real para el cerebro en la nube. Si la contraseña real era una larga cadena de letras y números, la falsa también es una larga cadena de letras y números. Si la ruta de archivo real era /Users/Alice/Secrets/Plan.pdf, la falsa podría verse como [REPO_ROOT_1]/Secrets/Plan.pdf. El cerebro en la nube aún puede leer la estructura: sabe que es un archivo, sabe que es un secreto y sabe cómo hablar de ello, pero no tiene idea de cuál es el secreto real. Es como darle al cerebro en la nube un mapa donde el tesoro está marcado con una "X" genérica en lugar de las coordenadas reales.

Pero la magia no termina ahí. Cuando el cerebro en la nube devuelve instrucciones como "Ve a abrir ese archivo", SlotGuard atrapa el mensaje antes de que llegue a tu robot. Revisa su propia lista secreta, ve que [REPO_ROOT_1] en realidad significa /Users/Alice/Secrets/Plan.pdf, y lo cambia de nuevo al original solo dentro de tu computadora de confianza. El robot entonces abre el archivo real, y el cerebro en la nube nunca supo que el nombre real existía.

Los investigadores probaron este sistema con tareas bastante serias. Crearon miles de escenarios falsos donde los robots intentaban realizar tareas que involucraban datos sensibles, como leer documentos privados o usar claves secretas. Descubrieron que sin SlotGuard, los robots filtraban casi todo: el 100% de las veces. Incluso los métodos simples de "redacción" (que simplemente reemplazan los secretos con palabras como [PASSWORD]), fueron un desastre; rompían la capacidad del robot para hacer su trabajo, haciendo que fallara el 97.5% de las veces porque el robot se confundía por la falta de detalles.

SlotGuard, sin embargo, fue un cambio radical. En sus pruebas, la versión completa del sistema (que incluye un gráfico de seguimiento inteligente) logró ocultar todos los datos de identificación plantados y detuvo todas las filtraciones de credenciales (0.0% de filtración). Para datos estructurales como rutas y correos electrónicos, eliminó el 100% de los caracteres sensibles visibles, con la excepción de un caso específico relacionado con rutas absolutas propiedad de la raíz (root), que sigue siendo una pequeña brecha en el prototipo actual. Mejor aún, no rompió el cerebro del robot. Los robots que usaban SlotGuard eran casi tan buenos en sus tareas como si hubieran visto los secretos reales, manteniendo sus tasas de éxito altas en diferentes modelos. El sistema es también increíblemente rápido, tomando menos de un parpadeo (unos 14 microsegundos) para reescribir un solo turno de conversación, por lo que no ralentiza nada.

El artículo también señala lo que SlotGuard no hace. No es un escudo de lectura de mente; si el cerebro en la nube es lo suficientemente inteligente como para adivinar tu secreto basándose solo en el contexto de la conversación, SlotGuard no puede detenerlo. Tampoco te protege si tu propia computadora ya ha sido hackeada. Pero para el problema específico de evitar que tus datos privados se filtren en las transcripciones de la nube, SlotGuard ofrece una solución robusta, rápida y astuta que mantiene tus secretos a salvo mientras permite que tu robot haga su trabajo.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →