← Últimos artículos
💻 computer science

PromptMark: A Prompt-Guided Iterative-Feedback Framework for Source Code Watermarking

PromptMark es un marco de trabajo de caja negra guiado por prompts que incrusta marcas de agua detectables en el código fuente generado por IA mediante instrucciones de entrada estructuradas y retroalimentación iterativa, logrando una fuerte atribución sin comprometer la funcionalidad del código ni requerir acceso a los componentes internos del modelo.

Autores originales: Istiaq Ahmed Fahad, Mridha Md. Nafis Fuad, Kazi Sakib

Publicado 2026-06-23
📖 5 min de lectura🧠 Análisis profundo

Autores originales: Istiaq Ahmed Fahad, Mridha Md. Nafis Fuad, Kazi Sakib

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina que eres un panadero que contrata a un chef robot, muy talentoso pero invisible, para hornear miles de hogazas de pan cada día. Quieres saber qué pan fue horneado por tu robot y cuál por un competidor humano, pero el robot no deja una firma y el pan se ve exactamente igual por fuera.

Este es el problema que PromptMark resuelve, pero en lugar de pan, se trata de código informático escrito por Inteligencia Artificial (IA).

Aquí te explico cómo la investigación presenta la solución, desglosada en conceptos simples:

1. El Problema: El Chef de la "Caja Negra"

En el mundo real, la mayoría de los desarrolladores no poseen los modelos de IA que utilizan; los alquilan a través de un servicio de "caja negra" (como un restaurante donde no puedes ver la cocina).

  • El Desafío: No puedes echar un vistazo al cerebro del robot para cambiar su forma de pensar (esto se llama acceso de "caja blanca"). Solo puedes darle una receta (un prompt) y esperar el plato (el código).
  • El Riesgo: Si la IA escribe código que se rompe o que roba crédito, es difícil demostrar que fue la IA. Además, si intentas forzar a la IA a escribir código de una manera extraña para marcarlo, el código podría dejar de funcionar (como un robot intentando hornear pan con un martillo).

2. La Solución: La Receta de la "Lista Verde"

Los investigadores crearon un método llamado PromptMark. En lugar de intentar hackear el cerebro del robot, simplemente cambian las instrucciones que le dan.

Piensa en esto como darle al chef robot una regla especial: "Para cada nombre de ingrediente nuevo que inventes, debes empezar el nombre con una letra de esta 'Lista Verde' específica (por ejemplo, A, B o C)".

  • La Lista Verde: Esta es una lista secreta de letras (p. ej., A, B, C) elegidas basándose en una clave secreta.
  • La Lista Roja: Estas son las letras con las que se le dice al robot que debe evitar empezar los nombres.
  • El Truco: El robot sigue estas reglas tan bien que comienza a nombrar sus variables (como apple_count o banana_loop) con letras de la "Lista Verde" con mucha más frecuencia de lo que un humano haría naturalmente.

3. El Bucle de "Retroalimentación Iterativa": La Prueba de Sabor

A veces, el robot podría olvidar la regla o escribir código que no funciona porque está intentando demasiado seguir la regla. Para solucionar esto, PromptMark utiliza un bucle de retroalimentación:

  1. Ronda 1: El robot escribe el código.
  2. La Verificación: Un humano (o otra computadora) comprueba dos cosas:
    • ¿Realmente funciona el código? (¿Subió el pan?)
    • ¿Siguió el robot la regla de la "Lista Verde" lo suficiente? (¿Hay suficientes nombres con A, B, C?)
  3. La Retroalimentación: Si el código está roto, se le dice al robot: "Corrige la lógica". Si el código funciona pero la regla de la Lista Verde es débil, se le dice: "Buen trabajo, pero usa más nombres con 'A' la próxima vez".
  4. Ronda 2: El robot lo intenta de nuevo con las nuevas instrucciones.

Esto continúa hasta que el código es perfecto y la marca de agua es fuerte.

4. La Detección: El "Detective Estadístico"

¿Cómo sabes si un trozo de código fue hecho por la IA? No necesitas ver la clave secreta. Solo tienes que mirar los nombres.

  • Código Natural: Los humanos nombran las cosas de forma aleatoria. Si observas 100 variables, tal vez 10 empiezan con 'A', 10 con 'B', etc. Es una mezcla equilibrada.
  • Código con Marca de Agua: Debido a que la IA fue forzada a usar la "Lista Verde", verás un patrón extraño. Tal vez el 60% de los nombres empiezan con 'A', 'B' o 'C'.
  • La Prueba: Una prueba estadística (como un detector matemático) cuenta estas letras. Si el patrón es demasiado fuerte como para ser una coincidencia, grita: "¡Esto fue escrito por la IA!".

5. Por qué es Especial

El artículo afirma que este método es especial por tres razones:

  • Es Invisible: El código sigue pareciendo normal y funciona perfectamente. La "marca de agua" es solo un patrón sutil en los nombres, como un mensaje oculto en la letra de una canción que solo notas si conoces el patrón.
  • Funciona en Cajas Negras: No necesitas poseer la IA ni ver su código interno. Solo hablas con ella como un usuario normal.
  • Es Seguro: La "Lista Verde" se genera utilizando una clave secreta (como una contraseña). Solo alguien con esa clave sabe qué letras buscar, lo que hace difícil que otros falsifiquen la marca de agua.

Los Resultados

Los investigadores probaron esto en dos conjuntos famosos de problemas de programación (MBPP y HumanEval) utilizando dos modelos de IA diferentes (Gemini y Claude).

  • Tasa de Éxito: El método marcó el código con éxito entre el 90% y el 98% de las veces sin romper el código.
  • Calidad: El código se mantuvo tan bueno como el código escrito sin la marca de agua.

Las Limitaciones (Lo que el artículo admite)

  • Ataques de Renombrado: Si alguien toma el código con la marca de agua y cambia manualmente todos los nombres de las variables por otros, la marca de agua desaparece. El artículo señala que, aunque el método es bueno, no es mágico; un humano decidido podría borrar la señal reescribiendo el código.
  • Específico de Lenguaje: El estudio se realizó en código Python. El artículo advierte que los lenguajes con reglas de nomenclatura diferentes podrían comportarse de manera distinta.

En resumen, PromptMark es una forma de susurrar una instrucción secreta a un chef de IA: "Nombra tus ingredientes con estas letras específicas", permitiéndote demostrar más tarde, con matemáticas, que la IA hizo el plato, todo sin arruinar el sabor de la comida.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →