← Últimos artículos
💻 computer science

The OpenHands Software Agent SDK: A Composable and Extensible Foundation for Production Agents

El artículo presenta el SDK de OpenHands, un kit de herramientas reestructurado y extensible que facilita el desarrollo y despliegue de agentes de ingeniería de software en producción mediante una arquitectura flexible, ejecución segura en entornos aislados y compatibilidad con múltiples interfaces e modelos de lenguaje.

Autores originales: Xingyao Wang, Simon Rosenberg, Juan Michelini, Calvin Smith, Hoang Tran, Engel Nyst, Rohit Malhotra, Xuhui Zhou, Valerie Chen, Robert Brennan, Graham Neubig

Publicado 2026-04-23
📖 5 min de lectura🧠 Análisis profundo

Autores originales: Xingyao Wang, Simon Rosenberg, Juan Michelini, Calvin Smith, Hoang Tran, Engel Nyst, Rohit Malhotra, Xuhui Zhou, Valerie Chen, Robert Brennan, Graham Neubig

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

¡Claro que sí! Imagina que OpenHands es como un taller de construcción de robots (agentes de IA) que ayuda a programar software.

Hace un tiempo, tenían un taller llamado Versión 0 (V0). Era funcional, pero era como un gigantesco bloque de cemento: todo estaba pegado, si querías cambiar una pequeña pieza, tenías que romper todo el edificio. Además, el robot siempre tenía que trabajar dentro de una jaula de seguridad (un "sandbox") muy rígida, lo que hacía que fuera lento y difícil de mover si querías que trabajara en tu propia computadora.

El Versión 1 (V1) que presentan en este artículo es como reconstruir ese taller con bloques de LEGO. Es modular, flexible y mucho más inteligente.

Aquí te explico los puntos clave con analogías sencillas:

1. De "Bloque de Cemento" a "Bloques de LEGO" (Arquitectura Modular)

  • Antes (V0): Todo estaba mezclado. El cerebro del robot, sus manos (herramientas), su memoria y la casa donde vivía estaban todos en un solo código gigante. Si querías usarlo en una web o en una terminal de comandos, tenías que hacer trucos extraños y duplicar código.
  • Ahora (V1): Han separado el taller en 4 cajas de herramientas distintas:
    1. El Cerebro (SDK): La lógica pura del agente.
    2. Las Herramientas: Lo que el agente puede hacer (editar archivos, navegar web).
    3. El Espacio de Trabajo: Dónde vive el agente (en tu PC o en un servidor remoto).
    4. El Servidor: La puerta de entrada para que otros se conecten.
    • La ventaja: Puedes tomar solo el cerebro y usarlo donde quieras, o conectarlo a diferentes espacios de trabajo sin tener que reescribir todo el código. Es como si pudieras usar el mismo motor de un coche, ya sea en una bicicleta o en un camión.

2. La "Caja de Seguridad" Opcional (Flexibilidad)

  • El problema anterior: El robot siempre tenía que trabajar dentro de una caja de cristal (sandbox) para no romper nada. Pero a veces, para tareas simples o rápidas, esa caja era un estorbo y hacía que el robot se tropezara con sus propios pies.
  • La solución: Ahora, el robot puede trabajar libremente en tu escritorio si es seguro hacerlo (como cuando escribes un código simple). Pero si la tarea es peligrosa o compleja, el sistema lo mete automáticamente en la caja de cristal.
  • Analogía: Es como tener un perro. Si vas al parque, lo sueltas (modo local). Si vas a una zona de construcción, le pones la correa (modo sandbox). Tú decides cuándo usar la correa, no el perro.

3. El "Libro de Bitácora" Infalible (Gestión de Estado)

  • El problema anterior: La memoria del robot era como una pizarra borrable que se desordenaba. Si algo fallaba, a veces no sabían en qué punto se quedaron, y el robot se confundía.
  • La solución: Ahora usan un sistema de "Eventos Inmutables". Imagina que el robot lleva un diario de bitácora donde escribe cada cosa que hace, paso a paso, en orden. Nada se borra, todo se añade.
    • Si el robot se cae (se apaga la luz), al encenderlo de nuevo, simplemente lee su diario desde el último punto y continúa.
    • Además, como el diario es inmutable (nadie puede cambiar lo que ya está escrito), es imposible que el robot se confunda con versiones falsas de la realidad.

4. El "Guardaespaldas" y el "Juez" (Seguridad)

  • Antes, el robot podía hacer cosas arriesgadas sin que nadie lo parara.
  • Ahora, tienen un Guardaespaldas (Security Analyzer) que revisa cada acción antes de que el robot la haga.
    • Si el robot quiere borrar un archivo importante, el guardaespaldas dice: "¡Espera! Eso es peligroso".
    • Entonces, el robot se detiene y le pregunta al humano: "¿Te parece bien que haga esto?".
    • Si el humano dice que sí, el robot continúa. Si dice que no, el robot busca otra forma más segura de hacerlo.

5. El "Traductor Universal" (Soporte de Modelos)

  • El SDK es como un traductor universal. No le importa si el "cerebro" del robot es de Google, OpenAI, Anthropic o un modelo gratuito.
  • Incluso puede usar cerebros que no saben hablar el idioma de las "herramientas" nativamente. El SDK les traduce las instrucciones para que puedan usar herramientas igual que los demás.

¿Por qué es importante esto? (Los Resultados)

El equipo probó esta nueva versión en la vida real (en producción) durante 15 días y los resultados fueron increíbles:

  • Menos errores: Los fallos del sistema bajaron un 61%. ¡Casi dos tercios de los problemas desaparecieron!
  • Más rápido: El sistema de "diario de bitácora" (event sourcing) es tan eficiente que apenas añade tiempo extra. Recuperarse de un fallo toma menos de 20 milisegundos (más rápido de lo que tardas en parpadear).
  • Mismo rendimiento: Aunque cambiaron toda la arquitectura, el robot sigue siendo tan inteligente como antes, e incluso más capaz de usar las nuevas funciones de los modelos más avanzados.

En resumen

El OpenHands Software Agent SDK es como pasar de tener un robot de juguete atascado en una caja a tener un equipo de construcción profesional donde puedes elegir las herramientas, el lugar de trabajo y el nivel de seguridad según lo que necesites. Hace que crear robots programadores sea más fácil, más seguro y mucho más fiable para el mundo real.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →