← Últimos artículos
💻 computer science

The Say-Do Gap Architecture Applied to Agentic AI: A Reproducible NLP Pipeline for Detecting Governance Rhetoric–Reality Divergence in Corporate ESG Communication

Este estudio introduce un flujo de trabajo de PLN bilingüe y reproducible que adapta la arquitectura del Índice de Brecha entre el Decir y el Hacer para detectar la divergencia entre la retórica corporativa y las prácticas de gobernanza observables con respecto a la IA agéntica dentro del índice IBEX 35, demostrando la capacidad de generalización del marco más allá de los dominios tradicionales de ESG.

Autores originales: Alfredo Merlet

Publicado 2026-08-28
📖 6 min de lectura🧠 Análisis profundo

Autores originales: Alfredo Merlet

Artículo original bajo licencia CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

En el mundo corporativo moderno, las empresas publican con frecuencia informes detallando sus planes para gestionar las nuevas tecnologías de manera responsable. Hablan de ética, seguridad y supervisión, prometiendo que el uso de sus herramientas avanzadas está bajo control. Sin embargo, un desafío persistente en los negocios y la gobernanza es la distancia entre lo que una organización dice que hará y lo que realmente hace. Esta brecha no es exclusiva de la tecnología; aparece siempre que una institución hace una afirmación pública sobre sus prácticas internas. Los investigadores han estudiado este fenómeno durante mucho tiempo, señalando que las palabras suelen ser más fáciles de producir que los cambios estructurales necesarios para respaldarlas. Cuando una empresa afirma gobernar un sistema complejo pero carece de los comités, políticas o certificaciones visibles para demostrarlo, el resultado es un desconectado entre la retórica y la realidad. Este desencuentro es importante porque puede confundir a inversores, reguladores y al público sobre el verdadero estado de la responsabilidad corporativa.

Un nuevo estudio de Alfredo Merlet, investigador del Instituto Profesional IACC, aborda este problema específicamente en relación con la "inteligencia artificial agéntica". Este término se refiere a un tipo de IA que puede actuar de forma autónoma, tomando decisiones y realizando pasos sin una dirección humana constante. A medida que estos sistemas se vuelven más comunes, las empresas están comenzando a discutir cómo los gobernarán. El trabajo de Merlet no se limita a preguntar si las empresas están hablando de esta tecnología; pregunta si sus palabras coinciden con sus acciones. Para responder a esto, el investigador construyó un nuevo sistema repetible diseñado para medir la brecha entre las promesas corporativas y la evidencia sólida de gobernanza. El estudio se centra en el IBEX 35, una lista de las treinta y cinco mayores empresas de España, utilizándolas como un caso de prueba para ver si el método funciona.

El núcleo de esta investigación es un "pipeline", o proceso paso a paso, que separa lo que una empresa dice de lo que realmente ha hecho. La parte del "Decir" en la ecuación proviene de los miles de artículos de noticias y comunicaciones corporativas que estas firmas han publicado entre 2023 y 2025. El investigador utilizó un programa informático especializado para escanear estos textos en busca de menciones a la gobernanza de la IA agéntica. El programa fue entrenado para reconocer un lenguaje específico relacionado con la supervisión y el control, distinguiendo entre una empresa que simplemente habla de usar IA y una que discute cómo gestiona los riesgos de esa IA. La parte del "Hacer" es diferente. En lugar de depender de lo que las empresas dicen, esta sección busca pruebas físicas. El investigador buscó tres tipos específicos de evidencia: la existencia de un comité a nivel de junta directiva dedicado a los riesgos tecnológicos, un documento de política formalmente publicado sobre la gobernanza de la IA, y la prueba de que la empresa cumple con estándares de certificación externos. Estos son elementos tangibles que pueden verificarse, a diferencia de un discurso o un comunicado de prensa.

Cuando el investigador aplicó este sistema a las treinta y cuatro empresas de la muestra, los resultados fueron sorprendentes, aunque quizás no de la manera que uno esperaría. El estudio encontró que el sistema detectó casi ninguna evidencia de discurso de gobernanza de la IA agéntica en las comunicaciones corporativas y, correspondientemente, ninguna evidencia de las estructuras de gobernanza específicas necesarias para gestionarla. En el periodo de 2023 a 2025, el análisis computarizado de noticias e informes encontró una prevalencia estructuralmente baja o nula de menciones a la IA agéntica, y la búsqueda de los tres tipos de evidencia sólida resultó vacía para la gran mayoría de las firmas. Para asegurar que no se trataba de un error en la lectura de la computadora, el investigador verificó manualmente una muestra de los artículos que la computadora había marcado como carentes de contenido relevante. Esta revisión humana confirmó que la computadora tenía razón: las empresas aún no estaban produciendo un discurso significativo sobre la gobernanza de la IA agéntica, ni estaban mostrando los pasos concretos de gobernanza que demostrarían que la estaban gestionando.

Este resultado es significativo porque demuestra que el método funciona. El estudio fue diseñado principalmente para probar si un marco originalmente construido para cuestiones ambientales y sociales generales podía adaptarse al mundo específico y técnico de la IA autónoma. El hecho de que el sistema identificara con éxito un resultado nulo —indicando una falta tanto de discurso como de acción— demuestra que la arquitectura es sólida y capaz de distinguir entre hallazgos genuinos y errores del clasificador. El investigador no pretendía acusar a estas empresas españas específicas de fallar; más bien, el objetivo era mostrar que existe una herramienta que puede medir la diferencia entre el discurso y la sustancia, incluso cuando esa diferencia es la ausencia de ambos. El estudio descarta explícitamente la idea de que esto sea una auditoría final de toda la industria o un juicio definitivo sobre la integridad de cada firma. En su lugar, presenta una herramienta reproducible que puede ser utilizada por otros para verificar diferentes mercados o diferentes tecnologías.

El valor de este trabajo reside en su transparencia y apertura. El investigador ha puesto todo el sistema a disposición del público, incluyendo la lista de palabras que la computadora busca y el código utilizado para encontrar la evidencia. Esto permite que otros científicos, reguladores o inversores utilicen el mismo método para verificar empresas en otros países o para observar diferentes tecnologías emergentes. El estudio sugiere que este enfoque puede adaptarse a mercados en América Latina y más allá, siempre que se tengan en cuenta los documentos y regulaciones específicos de esas regiones. Ofrece una forma de ir más allá de simplemente leer lo que las empresas afirman y avanzar hacia la verificación de lo que realmente han construido.

En última instancia, el artículo proporciona una forma clara y repetible de ver si la gobernanza de una empresa coincide con sus palabras. Muestra que, para la IA agéntica en esta muestra y ventana de tiempo específica, el panorama actual se caracteriza por una prevalencia estructuralmente baja tanto del discurso como de la evidencia estructural de control. Esto no significa que las empresas estén mintiendo, pero sí significa que la prueba visible de su gestión y el discurso que la rodea son actualmente inexistentes. El estudio concluye que este método de medir la brecha es una herramienta poderosa para comprender el comportamiento corporativo, una que puede aplicarse a cualquier situación en la que una organización haga una afirmación sobre cómo gestiona un sistema complejo. Al separar la promesa de la prueba, la investigación ofrece una nueva lente a través de la cual observar el panorama de la inteligencia artificial y la responsabilidad corporativa en rápida evolución.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →