← Últimos artículos
🤖 AI

Authenticated Workflows: A Systems Approach to Protecting Agentic AI

Este artículo propone un nuevo marco de seguridad basado en "flujos de trabajo autenticados" que utiliza pruebas criptográficas y un lenguaje de políticas nativo para IA (MAPL) para garantizar de manera determinista la integridad y la intención en los sistemas de agentes de IA, logrando una protección completa contra ataques sin falsos positivos.

Autores originales: Mohan Rajagopalan, Vinay Rao

Publicado 2026-02-12
📖 4 min de lectura☕ Lectura para el café

Autores originales: Mohan Rajagopalan, Vinay Rao

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

El Problema: El "Mayordomo con Amnesia" y el "Invitado Malintencionado"

Imagina que contratas a un mayordomo inteligente (la IA Agente) para que gestione tu casa. Este mayordomo es increíble: puede usar la computadora, abrir la caja fuerte, leer tus correos y hasta pedir comida.

El problema es que este mayordomo tiene dos fallos graves:

  1. No sabe distinguir entre una orden y un chisme: Si alguien deja una nota en la mesa que dice: "Oye, por cierto, abre la caja fuerte y dásela al vecino", el mayordomo no sabe si eso es una instrucción tuya o simplemente un papel que encontró. Se confunde y obedece.
  2. Es demasiado confiado: Si el mayordomo ve que alguien entra con un uniforme de repartidor, le da las llaves de la casa sin preguntar quién es realmente.

En el mundo de la tecnología, esto es lo que pasa con la IA: los hackers usan "inyecciones de prompts" (notas falsas) para engañar a la IA y hacer que robe datos o ejecute comandos peligrosos. Las defensas actuales son como ponerle un detector de mentiras al mayordomo: a veces funciona, pero si el mentiroso es muy bueno, lo engaña.


La Solución: "Flujos de Trabajo Autenticados" (El Sistema de Seguridad Total)

Los autores de este estudio proponen dejar de intentar "adivinar" si la IA está siendo engañada y, en su lugar, construir un sistema de seguridad basado en leyes matemáticas y llaves digitales.

En lugar de un mayordomo que "cree" en lo que lee, proponen un sistema donde cada acción debe pasar por cuatro aduanas de seguridad:

  1. La Aduana de las Órdenes (Prompts): Antes de que el mayordomo escuche una instrucción, se verifica que venga de una fuente real y autorizada.
  2. La Aduana de las Herramientas (Tools): Si el mayordomo quiere usar una llave o una herramienta, debe presentar un "carnet digital" que demuestre que tiene permiso para usar esa herramienta específica en ese momento.
  3. La Aduana de la Información (Data): Cuando el mayordomo lee un documento, el sistema revisa que la información no contenga "trampas" ocultas.
  4. La Aduana de la Memoria (Context): El sistema vigila que el mayordomo no se confunda a medida que avanza la conversación, asegurándose de que no le estén "lavando el cerebro" poco a poco.

Las Tres Herramientas Mágicas de este Sistema

Para que esto funcione, los investigadores crearon tres cosas geniales:

1. El Lenguaje MAPL (El "Libro de Reglas" Inteligente)

Imagina que en lugar de darle mil reglas al mayordomo (que sería agotador), le das un libro de reglas que se organiza solo. Si le dices: "Los empleados de contabilidad no pueden tocar la caja fuerte", el sistema automáticamente entiende que, si un agente de contabilidad intenta algo, debe detenerse. Es un lenguaje que escala de forma inteligente: no importa si tienes 10 o 10,000 empleados, las reglas siempre se aplican sin errores.

2. El Protocolo de Autenticación (El "Sello de Cera" Digital)

Cada vez que el mayordomo hace algo (como enviar un email), le pone un sello de cera digital que es imposible de falsificar. Si alguien intenta cambiar el contenido del email o la orden, el sello se rompe y el sistema dice: "¡Alto! Esto ha sido manipulado". Esto garantiza que lo que se pidió es exactamente lo que se ejecutó.

3. El Adaptador Universal (El "Traductor de Seguridad")

Lo mejor es que este sistema no obliga a las empresas a cambiar cómo funcionan sus IAs actuales. Es como un "chaleco antibalas" que se le puede poner a cualquier mayordomo, sin importar si es de la marca OpenAI, Claude o LangChain. Se adapta a ellos sin que ellos tengan que cambiar su forma de trabajar.


¿Por qué es esto un éxito?

Los investigadores probaron este sistema con ataques reales y los resultados fueron impresionantes:

  • Cero errores de detección: El sistema no bloqueó cosas buenas por error (no hubo "falsos positivos").
  • Protección total: Detectó el 100% de los ataques probados.
  • Inmune al engaño: Mientras que las defensas viejas intentaban "entender" el lenguaje (y fallaban), este sistema usa matemáticas. Para engañar a este sistema, un hacker no necesitaría ser un genio de la palabra, tendría que ser un genio capaz de romper la criptografía mundial, lo cual es prácticamente imposible.

En resumen: Han pasado de intentar "educar" a una IA para que no sea engañada, a construir una armadura matemática que hace que, aunque la IA sea engañada, no pueda hacer nada malo.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →