← Últimos artículos
💻 computer science

Operationalizing Ethics for AI Agents: How Developers Encode Values into Repository Context Files

Este documento de visión investiga cómo los desarrolladores están operacionalizando principios éticos mediante la codificación de reglas de comportamiento en archivos de contexto del repositorio (por ejemplo, AGENTS.md) para guiar agentes de IA, proponiendo una agenda de investigación para estudiar la variación, la gobernanza y el cumplimiento de estas directrices emergentes escritas por desarrolladores.

Autores originales: Christoph Treude, Sebastian Baltes, Marc Cheong

Publicado 2026-05-08
📖 4 min de lectura☕ Lectura para el café

Autores originales: Christoph Treude, Sebastian Baltes, Marc Cheong

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina que estás contratando a un asistente robot muy inteligente y muy rápido para ayudarte a construir una casa. Quieres que este robot no solo sea eficiente, sino también amable, justo y seguro. En el pasado, podrías haber escrito un largo y serio manual de reglas para los trabajadores humanos, esperando que lo leyeran y recordaran ser buenos. Pero los robots no leen los manuales de reglas de la misma manera que lo hacen los humanos.

Este artículo argumenta que los desarrolladores ahora están probando un nuevo y astuto truco: están escribiendo manuales de instrucciones específicos directamente en el espacio de trabajo del robot.

Aquí está el desglose de lo que dice el artículo, utilizando analogías simples:

1. El Problema: "Sé bueno" es demasiado vago

Imagina decirle a tu asistente robot: "Por favor, sé ético". Eso es como decirle a un niño: "Sé bueno". Es una idea agradable, pero no le dice al robot cómo ser bueno. ¿Debería detenerse si ve un error? ¿Debería hablar con cortesía? ¿Debería verificar si está siendo injusto con diferentes personas? El artículo dice que, aunque hablamos mucho de "ética de la IA" en grandes reuniones, es difícil convertir esas grandes ideas en instrucciones reales que una máquina pueda seguir.

2. La Solución: El archivo "AGENTS.md"

Los autores descubrieron que los desarrolladores están comenzando a crear archivos especiales en sus proyectos de código llamados AGENTS.md (o archivos de contexto similares). Piensa en estos archivos como las "Reglas de la Casa" pegadas justo en la encimera de la cocina donde trabaja el robot.

En lugar de simplemente decir "Sé justo", los desarrolladores están escribiendo comandos específicos y accionables como:

  • Para la equidad: "Al probar nombres, usa una mezcla como 'John Smith', 'José García' y '李明' para asegurarte de que el sistema no trate a las personas de manera diferente basándose en sus nombres".
  • Para el tono: "No des sermones morales ni opiniones no solicitadas. Solo haz el trabajo".
  • Para la inclusión: "Escribe en inglés sencillo para que los hablantes no nativos puedan entender".
  • Para la sostenibilidad: "Usa menos datos y energía de la batería para ayudar al medio ambiente".

3. Lo que encontraron (La "Investigación preliminar")

Los investigadores miraron algunos de estos archivos (como asomarse a unas pocas casas diferentes) y descubrieron que los desarrolladores ya están haciendo esto. No están escribiendo solo filosofía abstracta; están traduciendo valores en reglas legibles por máquina.

  • La equidad se convierte en un script de prueba específico.
  • La responsabilidad se convierte en una regla para mantener a un humano a cargo de los cambios.
  • La inclusión se convierte en una regla sobre qué palabras usar.

Es como si el desarrollador dijera: "No solo quiero que mi robot sea justo; estoy programando al robot para que ejecute una verificación de equidad antes de terminar su trabajo".

4. Las Grandes Preguntas (La hoja de ruta de investigación)

El artículo no afirma tener todas las respuestas todavía. En su lugar, sugiere un nuevo camino para la investigación, planteando preguntas como:

  • ¿Los robots realmente escuchan? Si escribimos estas reglas, ¿las siguen los robots o simplemente las ignoran?
  • ¿Quién decide las reglas? Si dos desarrolladores discrepan sobre lo que significa "justicia", ¿cómo debaten sobre ello en el archivo?
  • ¿Cambian las reglas? Si un robot comete un error, ¿actualizan los desarrolladores las "Reglas de la Casa" para evitar que vuelva a ocurrir?

La Conclusión

Este artículo es una pieza de "visión". Dice: "Miren, los desarrolladores ya están intentando enseñar ética a la IA escribiendo instrucciones específicas en los archivos de código".

Los autores quieren que estudiemos esta práctica. Creen que si queremos entender cómo se gobierna la IA en el mundo real, no deberíamos mirar solo las grandes leyes o teorías abstractas. En su lugar, deberíamos mirar estos pequeños archivos de instrucciones cotidianos donde los desarrolladores están realmente intentando convertir "ser bueno" en "hacer el bien" para el robot.

En resumen: Estamos pasando de decirle a la IA "Sé una buena persona" a darle a la IA una lista de verificación específica de tareas de "Buena Persona" para marcar mientras trabaja.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →