← Últimos artículos
💻 computer science

Deterministic vs. LLM-Controlled Orchestration for COBOL-to-Python Modernization

Este artículo presenta un estudio empírico controlado que demuestra que la orquestación determinista supera a los flujos de trabajo agénticos controlados por LLM en la modernización de COBOL a Python al lograr una precisión de traducción comparable, mientras mejora significativamente la robustez, reduce la variabilidad del rendimiento y disminuye los costos operativos hasta en 3.5 veces.

Autores originales: Naing Oo Lwin, Rajesh Kumar

Publicado 2026-08-21
📖 5 min de lectura🧠 Análisis profundo

Autores originales: Naing Oo Lwin, Rajesh Kumar

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Durante décadas, los sectores financiero y gubernamental han dependido de programas informáticos masivos e intrincados escritos en un lenguaje llamado COBOL. Estos sistemas ejecutan las transacciones bancarias y los pagos de la seguridad social del mundo; sin embargo, los expertos que los construyeron se están jubilando y el código en sí mismo suele tener décadas de antigüedad, estar mal documentado y ser difícil de modificar. Para mantener la operatividad de estos servicios vitales, las organizaciones deben traducir este código antiguo a lenguajes modernos como Python, un proceso que requiere una precisión extrema porque incluso un error minúsculo puede hacer que un sistema falle. Recientemente, ha surgido un nuevo tipo de inteligencia artificial conocido como modelo de lenguaje extenso como una herramienta potencial para esta tarea. Estos modelos pueden leer código y escribir código nuevo, pero a menudo funcionan actuando como agentes autónomos: deciden por sí mismos qué pasos tomar, cuándo reintentar una tarea y cómo corregir errores sobre la marcha. Esto plantea una pregunta crítica para los ingenieros: ¿es mejor dejar que la inteligencia artificial conduzca todo el proceso, decidiendo cada movimiento en tiempo real, o es más efectivo mantener el proceso en una trayectoria estricta y predefinida donde la computadora siga un conjunto fijo de reglas?

Un equipo de investigadores de la Universidad de Bucknell y Astrio se propuso responder a esta pregunta realizando un experimento controlado para ver cómo estos dos enfoques diferentes manejan la difícil labor de convertir código COBOL en Python. Construyeron un sistema llamado ATLAS para actuar como el traductor, pero diseñaron el experimento de modo que lo único que cambiaba entre las pruebas era quién estaba al volante. En una versión, la inteligencia artificial tenía el control total, permitiéndole elegir su propio camino, seleccionar sus propias herramientas y decidir cuándo detenerse o empezar de nuevo. En la otra versión, se utilizó la misma inteligencia artificial para escribir el código, pero un conjunto de reglas rígidas e inalterables dictaba exactamente qué pasos tomar, en qué orden y cuántas veces intentar de nuevo si algo salía mal. Al mantener el cerebro del sistema —el modelo de lenguaje— exactamente igual en ambos escenarios, los investigadores pudieron aislar el efecto del método de control en sí, eliminando todas las demás variables para ver qué estrategia funcionaba realmente mejor.

Los resultados de este estudio revelaron un claro compromiso entre flexibilidad y fiabilidad. Cuando se permitía que la inteligencia artificial controlara el proceso, frecuentemente lograba producir un programa funcional, teniendo éxito a menudo en la generación de un resultado que podía ejecutarse sin colapsar. Sin embargo, este éxito conllevaba un costo oculto: los resultados eran inconsistentes. Debido a que el modelo tomaba sus propias decisiones sobre cómo proceder, el mismo código inicial podía conducir a resultados muy diferentes en distintos intentos, produciendo a veces una traducción perfecta y otras veces fallando de maneras impredecibles. Además, este enfoque "agéntico" era increíblemente costoso. El modelo a menudo se perdía en largos y sinuosos caminos de razonamiento, haciéndose preguntas a sí mismo y probando múltiples estrategias que no eran necesarias, consumiendo vastas cantidades de recursos computacionales. En algunos casos, el enfoque flexible utilizó más de tres veces más tokens —las unidades básicas de información que el modelo procesa— que el enfoque fijo para lograr un resultado similar.

En contraste, el sistema que siguió una trayectoria fija y determinista produjo resultados que eran mucho más estables y predecibles. Si bien la capacidad general para traducir el código era tan buena como la de la versión flexible, el sistema rígido rara vez fallaba en los peores casos. No se perdía en bucles de pensamiento innecesario y no variaba su comportamiento de una ejecución a otra. Lo más importante es que era significativamente más barato de ejecutar. Al ceñirse a un programa estricto de pasos y utilizar la inteligencia artificial únicamente para escribir el código en lugar de para planificar el viaje, el sistema redujo el costo de la traducción en un factor de tres a tres y medio. Los investigadores descubrieron que para tareas como la modernización de software heredado, donde los pasos están bien definidos y los resultados pueden verificarse mediante reglas estrictas, dejar que la inteligencia artificial condujera el coche no solo era más caro, sino también menos fiable que tener un mapa diseñado por humanos guiando el camino.

Este estudio sugiere que el futuro del uso de la inteligencia artificial en tareas de ingeniería complejas puede no residir en dar a las máquinas libertad total para decidir cómo trabajar. En cambio, el enfoque más efectivo parece ser integrar estos poderosos modelos dentro de un marco estructurado donde las reglas de compromiso sean fijas y el camino sea claro. La inteligencia artificial sigue siendo el escritor experto, capaz de comprender instrucciones complejas y generar nuevo código, pero la orquestación del trabajo —la planificación, la temporización y los controles de seguridad— permanece bajo un control estricto y determinista. Esto asegura que el proceso no solo sea capaz de producir resultados de alta calidad, sino que también sea robusto, predecible y económicamente viable para los sistemas críticos y a gran escala que mantienen en funcionamiento nuestro mundo moderno.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →