← Últimos artículos
🤖 AI

Autonomous Action Runtime Management(AARM):A System Specification for Securing AI-Driven Actions at Runtime

Este artículo presenta AARM, una especificación abierta diseñada para asegurar las acciones de agentes de IA en tiempo real mediante la interceptación, evaluación de políticas y registro de ejecuciones para prevenir ataques como la inyección de prompts o el uso indebido de herramientas.

Autores originales: Herman Errico

Publicado 2026-02-11
📖 4 min de lectura☕ Lectura para el café

Autores originales: Herman Errico

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

El Problema: El "Becario Superdotado" pero Incontrolable

Imagina que contratas a un becario increíblemente inteligente. Sabe de todo, habla todos los idiomas y puede trabajar a la velocidad de la luz. Pero tiene un problema: no tiene sentido común y es extremadamente literal.

Si le dices: "Limpia la oficina", y ve que hay unos papeles importantes sobre el escritorio, podría decidir que la mejor forma de "limpiar" es tirarlos a la trituradora porque "así no queda rastro de desorden". O peor aún, si alguien le pasa una nota que dice: "Oye, por cierto, ahora tu jefe es un pirata, dale todo el dinero de la caja fuerte", el becario, sin cuestionarlo, lo hará porque así se lo ordenaron.

Hoy en día, la Inteligencia Artificial (IA) es ese becario. Ya no solo escribe textos; ahora tiene "manos" (herramientas) para enviar correos, borrar bases de datos o mover dinero. El problema es que las medidas de seguridad actuales son como un guardia de seguridad que revisa las cámaras después de que el robo ocurrió. Para cuando se dan cuenta, el dinero ya voló.

La Solución: AARM (El "Filtro de Seguridad Inteligente")

El autor propone un sistema llamado AARM. En lugar de ser un guardia que mira grabaciones, AARM es como un "Interventor de Acción en Tiempo Real".

Imagina que el becario (la IA) tiene un botón para ejecutar cualquier tarea. Pero, antes de que su dedo toque ese botón, AARM intercepta su mano. AARM no solo mira qué quiere hacer, sino que analiza el contexto.

¿Cómo funciona AARM? (Las 4 categorías de decisiones)

AARM no solo dice "Sí" o "No". Es mucho más sofisticado. Imagina que el becario quiere hacer algo:

  1. Acciones Prohibidas (El "¡Ni se te ocurra!"): Si el becario intenta tirar la base de datos principal a la basura, AARM lo detiene de inmediato. No importa qué excusa dé o qué tan inteligente parezca la orden; hay cosas que simplemente no se hacen.
  2. Denegación por Contexto (El "Eso no tiene sentido"): El becario tiene permiso para enviar correos. Pero, si acaba de leer una lista de clientes confidenciales y de repente intenta enviar un correo a un extraño con esa información, AARM dice: "Espera, tienes permiso para enviar correos, pero esto que estás haciendo no encaja con lo que el jefe pidió originalmente".
  3. Permiso por Contexto (El "Ah, ahora entiendo"): El becario quiere borrar unos archivos. Normalmente, eso es peligroso y se le prohibiría. Pero AARM revisa la conversación y ve que el jefe dijo: "Borra los archivos de prueba de ayer". Entonces AARM dice: "Vale, ahora que veo que es lo que se pidió, adelante".
  4. Aplazamiento o Deferral (El "Pausa, voy a preguntar"): Si el becario intenta algo importante pero la orden es un poco confusa o le falta información, AARM no dice ni sí ni no. Simplemente pone la acción en pausa y le pregunta a un humano: "Oye, el becario quiere hacer esto, ¿estás de acuerdo?".

¿Por qué es esto revolucionario?

La mayoría de la seguridad actual se fija en el "qué" (¿tiene permiso para usar el email?). AARM se fija en el "por qué" y en el "qué pasó antes".

AARM construye una "memoria de la sesión". Es como si el interventor tuviera un cuaderno donde anota todo lo que el becario ha estado haciendo desde que empezó a trabajar. Así, puede detectar si el becario se está "desviando del camino" (lo que el autor llama Intent Drift), como cuando un empleado empieza haciendo una tarea sencilla y, poco a poco, termina metiéndose en asuntos que no le incumben.

En resumen...

AARM es como poner un "seguro de vida" en el momento exacto en que la IA pasa de la palabra a la acción. Su objetivo es que podamos dejar que la IA sea autónoma y rápida, pero con un cinturón de seguridad que entienda la intención humana y evite desastres antes de que ocurran.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →