← Últimos artículos
🤖 AI

Concepts for Securing Agentic AI Coding and the Terok Environment

Este artículo aborda los significativos riesgos de seguridad informática introducidos por la IA Agéntica en el desarrollo de software mediante la presentación de una evaluación exhaustiva de estas amenazas, la propuesta de una estrategia de mitigación que preserve los beneficios de la tecnología y el detalle de una implementación de este concepto para permitir una adopción segura y responsable.

Autores originales: Jiří Vyskočil, Franz Pöschel, Andreas Knüpfer

Publicado 2026-08-25
📖 5 min de lectura🧠 Análisis profundo

Autores originales: Jiří Vyskočil, Franz Pöschel, Andreas Knüpfer

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina un nuevo tipo de asistente de software que no solo espera instrucciones, sino que actúa según ellas. En el mundo de la programación informática, este cambio representa el paso de una herramienta que sugiere código a un compañero que puede escribirlo, probarlo y corregir sus propios errores sin supervisión humana constante. Esto se conoce como inteligencia artificial agéntica. Si bien esta tecnología promete hacer que el desarrollo de software sea más rápido y eficiente, introduce un problema único y serio: para ser útil, el agente debe tener el poder de modificar archivos, ejecutar comandos y acceder a internet en tu computadora. Este mismo poder, si el agente comete un error o es engañado, podría permitirle robar tus datos privados, instalar software dañino o dañar tu sistema. La pregunta que enfrentan los desarrolladores es cómo aprovechar esta poderosa nueva herramienta sin dejar que actúe sin control.

Un equipo de investigadores del Centro de Comprensión de Sistemas Avanzados y el Helmholtz-Zentrum Dresden-Rossendorf en Alemania ha abordado este desafío diseñando un entorno seguro específicamente para estos agentes de codificación autónomos. Argumentan que los beneficios de dejar que un agente trabaje de forma independiente —como su capacidad para compilar código automáticamente, ejecutar pruebas y corregir errores— son demasiado valiosos como para ignorarlos, pero conllevan riesgos severos que no pueden resolverse simplemente pidiéndole al agente que se comporte. En lugar de intentar controlar la mente del agente, los investigadores construyeron una barrera física y digital a su alrededor. Crearon un sistema llamado Terok, que actúa como un entorno de pruebas (sandbox) seguro donde el agente puede operar libremente, pero solo dentro de límites estrictos que protegen al resto de la computadora y al internet en general.

El núcleo de su solución es un concepto de separación. Los investigadores tratan al agente de codificación como algo no confiable, lo que significa que asumen que podría causar daño de forma accidental o intencionada. Para gestionar esto, aíslan al agente en un contenedor, que es un espacio ligero y autónomo en la computadora donde el agente puede ejecutar cualquier comando que desee sin afectar los archivos personales del usuario o el sistema operativo principal. Si el agente intenta instalar un virus o eliminar un archivo, esto solo afectará a este espacio aislado, dejando el resto de la computadora intacto. Este aislamiento es la primera línea de defensa, asegurando que incluso si el agente se comporta como un virus, no pueda escapar de su jaula.

Sin embargo, el aislamiento por sí solo no es suficiente porque el agente aún necesita comunicarse con el mundo exterior para descargar librerías de código o hablar con el servicio de inteligencia artificial que lo impulsa. Para manejar esto, los investigadores añadieron una segunda capa de protección: un firewall estricto que controla cada conexión saliente. Por defecto, el agente tiene bloqueado el contacto con cualquier servidor externo. Si el agente necesita acceder a un sitio web específico para realizar su trabajo, el sistema pide permiso al usuario humano. Esto evita que el agente envíe accidentalmente datos privados al lugar equivírangle o descargue software malicioso de una fuente comprometida.

La tercera y quizás más ingeniosa salvaguarda involucra cómo el agente interactúa con el repositorio de código del proyecto, que es el lugar central donde se almacena y comparte el código de software. En lugar de permitir que el agente escriba directamente en el proyecto principal, el sistema crea un espejo local temporal de ese repositorio. El agente trabaja en esta copia, realizando cambios y confirmándolos como si fueran los reales. Una vez que el agente termina su tarea, el usuario humano revisa los cambios en este espejo local. Solo después de que el usuario aprueba el trabajo, este se transfiere al proyecto principal. Esto asegura que cualquier error oculto o código malicioso insertado por el agente sea detectado antes de que llegue al proyecto público o al código compartido del equipo.

Finalmente, el sistema protege las claves secretas y las contraseñas que el agente necesita para funcionar. Estas credenciales, como la contraseña para hablar con el servicio de inteligencia artificial o la clave para acceder al repositorio de código, se almacenan de forma segura fuera del espacio aislado del agente. Cuando el agente necesita usarlas, el sistema inyecta la información en el último momento sin permitir que el agente vea o copie el secreto real. Esto evita que un agente comprometido robe estas claves y las utilice para atacar otros sistemas o suplantar al usuario.

Los investigadores presentan Terok como un entorno de software de código abierto que implementa estos conceptos de protección. Proponen que este método permite a los desarrolladores utilizar todo el poder de la inteligencia artificial agéntica —dejando que ejecute tareas complejas, corrija sus propios errores y consulte internet— manteniendo los riesgos contenidos. El sistema no elimina la posibilidad de que el agente cometa un error o sea engañado, pero asegura que las consecuencias de tales eventos se limiten al entorno aislado y no se propaguen a los datos personales del usuario o a la red en general.

Este trabajo no pretende ser una solución permanente o perfecta, ya que el campo de la inteligencia artificial se mueve muy rápidamente. Los investigadores reconocen que pueden surgir nuevos tipos de riesgos y que el sistema deberá evolucionar. También señalan que algunos riesgos, como la posibilidad de que los humanos olviden cómo programar si dependen demasiado de estas herramientas, no pueden resolverse mediante la tecnología por sí sola. Sin embargo, su enfoque proporciona una forma práctica y segura de explorar el potencial de la codificación agéntica hoy en día. Al crear un espacio seguro donde estas poderosas herramientas puedan ser probadas y utilizadas responsablemente, los investigadores esperan fomentar que la comunidad de desarrollo adopte esta tecnología sin temor a los graves riesgos de seguridad que actualmente la frenan. El resultado es un sistema que equilibra la emoción de las nuevas capacidades con la necesidad de seguridad, permitiendo que los humanos mantengan el control mientras las máquinas realizan el trabajo pesado.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →