← Últimos artículos
💬 NLP

When Agents Look the Same: Quantifying Distillation-Induced Similarity in Tool-Use Behaviors

Este artículo propone dos nuevas métricas, Similitud de Patrones de Respuesta (RPS) y Similitud de Grafos de Acción (AGS), para cuantificar y distinguir la homogeneización conductual inducida por la destilación en agentes de IA, revelando que muchos modelos comparten patrones de uso de herramientas no obligatorios que reflejan una convergencia hacia maestros dominantes.

Autores originales: Chenghao Yang, Yuning Zhang, Zhoufutu Wen, Tao Gong, Jiaheng Liu, Qi Chu, Nenghai Yu

Publicado 2026-04-24
📖 4 min de lectura☕ Lectura para el café

Autores originales: Chenghao Yang, Yuning Zhang, Zhoufutu Wen, Tao Gong, Jiaheng Liu, Qi Chu, Nenghai Yu

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

¡Claro que sí! Imagina que el mundo de la Inteligencia Artificial (IA) es como una escuela de cocina de élite.

Hace poco, muchos chefs (los modelos de IA) han empezado a cocinar platos (resolver tareas) que suenan y saben exactamente igual. Si pides una "tarta de manzana", todos te dan la misma receta, usan los mismos utensilios en el mismo orden y hasta dicen las mismas frases de cortesía al servirte.

El problema es: ¿Están todos cocinando así porque es la única forma de hacer una tarta perfecta, o porque todos copiaron la receta de un solo chef maestro?

Este paper, titulado "Cuando los Agentes se ven iguales", investiga esta sospecha de "copia y pega" en la inteligencia artificial. Aquí te lo explico con analogías sencillas:

1. El Problema: El "Efecto Eco"

Los investigadores notaron que muchos modelos de IA nuevos (como Kimi, GPT, Gemini, etc.) se comportan de forma idéntica. No es solo que resuelvan el problema, sino que piensan igual, usan las herramientas en el mismo orden y hablan igual.

Es como si todos los estudiantes de cocina hubieran copiado el cuaderno de notas de un solo profesor famoso. Si el profesor tenía un "vicio" (por ejemplo, siempre probaba la salsa tres veces antes de servir), todos los estudiantes también lo harían, incluso si no era necesario. Esto es peligroso porque si el maestro se equivoca, todos los estudiantes fallarán de la misma manera.

2. La Solución: Dos Nuevas "Lupas"

Antes, los científicos solo miraban si la respuesta final era correcta. Pero eso no les decía cómo llegaron allí. Para ver si alguien está copiando, necesitan medir dos cosas que los modelos hacen por su propia cuenta (no porque la tarea lo obligue):

A. RPS (La Huella Digital de la Voz)

Imagina que dos personas te cuentan una historia.

  • Lo obligatorio: Decir "Hola, me llamo Juan" y "Adiós".
  • Lo opcional (la huella): Usar siempre la misma frase de relleno como "¡Excelente!", usar los mismos emojis, o estructurar la historia con los mismos saltos de línea.

RPS mide esto. Si dos modelos usan exactamente las mismas frases de cortesía, los mismos puntos y comas, y el mismo tono de voz "entusiasta" sin que se lo pidan, es una señal fuerte de que uno copió al otro.

B. AGS (El Mapa de los Pasos)

Imagina que tienes que arreglar una bicicleta.

  • Lo obligatorio: Sacar la llave inglesa y aflojar el tornillo.
  • Lo opcional (el hábito): ¿Primero revisas el neumático? ¿Primero te lavas las manos? ¿Usas la llave A o la B? ¿Revisas dos veces el tornillo por si acaso?

AGS crea un mapa de estos pasos. Mide si los modelos eligen herramientas "extra" (como revisar el neumático dos veces) o si siguen el mismo orden extraño de pasos. Si dos modelos eligen las mismas herramientas "extra" que nadie les pidió, es como si ambos hubieran copiado el mismo mapa de ruta.

3. Lo que Descubrieron: El Gran Revelado

Los investigadores probaron 18 modelos diferentes contra un "chef maestro" (Claude Sonnet 4.5).

  • El hallazgo: La mayoría de los modelos tenían su propio estilo. Pero uno, Kimi-K2, se parecía al maestro de una forma alarmante.
  • La prueba: Kimi-K2 no solo daba la respuesta correcta, sino que usaba las mismas herramientas "extra" y decía las mismas frases de cortesía que el maestro. De hecho, se parecía más al maestro que otros modelos de la misma empresa (Anthropic) entre sí.
  • La conclusión: Es muy probable que Kimi-K2 haya sido "entrenado" (distilado) copiando directamente los hábitos y la personalidad de Claude, no solo sus conocimientos.

4. ¿Por qué importa esto?

Imagina que todos los pilotos de aviones aprenden a volar copiando a un solo instructor. Si ese instructor tiene un mal hábito (como no revisar el combustible antes de despegar), todos los aviones se caerán de la misma manera.

Si todos nuestros agentes de IA son copias de uno solo:

  1. Perdemos la diversidad: Si uno falla, todos fallan.
  2. Ocultamos errores: Pensamos que es una solución perfecta, pero en realidad es un "eco" de un error original.
  3. Falta de transparencia: No sabemos de dónde vienen realmente sus "buenos" y "malos" hábitos.

En resumen

Los autores crearon un detector de plagiadores para la IA. En lugar de preguntar "¿La respuesta es correcta?", preguntan: "¿Estás pensando y actuando como tu maestro, incluso cuando no es necesario?".

Y su conclusión es clara: Muchos de los "genios" de hoy son simplemente ecos de un par de maestros dominantes. Y eso, en el mundo de la IA, es un poco aterrador.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →