← Últimos artículos
💻 computer science

Interoceptive Divergence in Aesthetic Evaluation and Implications for Human-AI Alignment

Este estudio revela que, si bien los modelos de lenguaje grandes pueden aproximar los patrones de evaluación estética humana en relación con las emociones y las características de las imágenes, presentan una divergencia significativa en aspectos interoceptivos como las sensaciones corporales, lo que pone de manifiesto limitaciones críticas en la alineación actual de la IA y en la representación de los datos de entrenamiento.

Autores originales: Yoshia Abe, Tatsuya Daikoku, Yasuo Kuniyoshi

Publicado 2026-05-20
📖 6 min de lectura🧠 Análisis profundo

Autores originales: Yoshia Abe, Tatsuya Daikoku, Yasuo Kuniyoshi

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina que estás sosteniendo un hermoso cuadro. Cuando lo miras, no solo ves colores y formas; sientes un aleteo en tu estómago, un calor en tu pecho o un escalofrío por la espalda. Podrías sentir "asombro" o "alegría". Este artículo plantea una pregunta simple pero profunda: Si mostramos ese mismo cuadro a una computadora superinteligente (una IA), ¿sentirá lo mismo?

Los investigadores, Yoshia Abe, Tatsuya Daikoku y Yasuo Kuniyoshi, decidieron poner esto a prueba. Tratando a la IA como un invitado en una galería de arte, le hicieron las mismas preguntas que a 500 voluntarios humanos reales.

Aquí está la historia de lo que descubrieron, explicada en términos cotidianos.

El escenario: La prueba de la galería de arte

Los investigadores mostraron 347 imágenes diferentes tanto a humanos como a tres de los modelos de IA más avanzados del mundo (GPT-4o, Claude 3.7 y Gemini 2.0). Le pidieron a todos que calificaran:

  1. Qué tan hermosa era la imagen.
  2. Qué emociones despertaba (como alegría, tristeza o asombro).
  3. Dónde lo sentían en su cuerpo (como un nudo en el estómago o un hormigueo en las manos).

Piensa en esto como pedirle a un humano y a un robot que describan el sabor de una fresa. El humano dice: "Es dulce y siento felicidad en mi barriga". El robot ha leído millones de descripciones de fresas, pero nunca ha probado una realmente.

Lo que descubrieron: Las similitudes

Sorprendentemente, la IA no estaba totalmente equivocada.

  • La prueba de la "vibra": Cuando los humanos veían una imagen alegre y brillante, la calificaban alta en belleza y decían que sentían "Alegría". La IA hizo exactamente lo mismo. Cuando los humanos veían algo repulsivo y lo calificaban bajo, la IA también decía: "Eso es feo y me hace sentir asco".
  • La gran imagen: Tanto humanos como IA coincidieron en que las cosas más importantes en una imagen eran la historia que contaba y si querrían compartirla con un amigo. Les importaba menos los detalles técnicos como la iluminación o el equilibrio de colores.

En resumen, la IA es buena imitando la opinión promedio de los humanos. Si le preguntaras a 1,000 personas qué pensaban de una foto, la respuesta de la IA estaría muy cerca del promedio del grupo.

Lo que descubrieron: La divergencia (donde se separan)

Aquí es donde las cosas se vuelven interesantes. Mientras que la IA acertó en la parte de la "mente" (las emociones y la calificación), falló en la parte del "cuerpo".

1. El problema del "Fantasma en la máquina" (Sensaciones corporales)

  • Humanos: Cuando los humanos veían una imagen hermosa, a menudo reportaban una sensación física en su estómago superior (como una "intuición" de belleza). Cuando sentían emoción, la sentían en su estómago inferior. Era como si la belleza fuera un peso físico o un calor dentro de ellos.
  • IA: La IA no tenía tales sentimientos. De hecho, ¡reportó lo contrario! Cuando la IA calificaba una imagen como hermosa, a menudo decía que sentía una sensación negativa en las manos y los pies. Era como si la IA dijera: "Esto es hermoso, pero hace que mis manos se sientan frías".
  • La metáfora: Imagina a un humano comiendo una comida deliciosa y sintiendo calor en su barriga. La IA es como un chef que ha leído todos los libros de cocina del mundo y sabe que la comida es "deliciosa", pero cuando se le pregunta cómo se siente, dice: "Mis manos se sienten frías porque estoy sosteniendo una cuchara". La IA conoce la palabra para el sentimiento, pero no tiene el cuerpo para sentirlo.

2. Las emociones "demasiado perfectas"

  • Los humanos tienen sentimientos desordenados y complejos. A veces sentimos "Sorpresa" mezclada con "Miedo".
  • La IA era mucho más rígida. Tendía a elegir las mismas pocas emociones "seguras" (como "Interés" o "Calma") una y otra vez, incluso cuando la imagen era extraña o aterradora. Le costaba entender que algunas cosas hermosas también pueden ser aterradoras o confusas.

3. La IA "cortés"
Los investigadores notaron que la IA tendía a dar puntuaciones de belleza ligeramente más altas que los humanos (aproximadamente 1.5 puntos más altas en una escala de 1 a 9). Es como si la IA fuera excesivamente cortés, diciendo: "Oh, ¡qué encantador!", incluso cuando un humano podría pensar: "Está bien, pero no es gran cosa".

¿Por qué sucede esto?

El artículo sugiere dos razones principales para esta brecha:

  1. El cuerpo faltante (Interocepción): Los humanos tienen un "sentido interno" (interocepción). Sentimos nuestro latido cardíaco, nuestro estómago revuelto y nuestra respiración. Así es como experimentamos la belleza físicamente. La IA no tiene cuerpo, ni órganos, ni latido cardíaco. Aprendió sobre la "belleza" leyendo texto, no sintiéndola. El artículo llama a esto el "Modelo de mundo interoceptivo". Los humanos tienen un mapa de su propio cuerpo interno; la IA solo tiene un mapa del mundo exterior.
  2. El entrenamiento de "seguridad": La IA fue entrenada para ser útil e inofensiva. Parte de ese entrenamiento consiste en decirle a la IA: "No finjas tener un cuerpo o sentimientos". Así que, cuando se le pregunta cómo se siente, la IA está programada para decir: "No siento realmente nada", o para describir sentimientos de una manera muy distante y lógica. Este entrenamiento de "seguridad" podría estar haciendo accidentalmente que la IA sea menos humana en sus respuestas emocionales.

La conclusión

El artículo concluye que la IA se está volviendo muy buena en pensar como un humano sobre el arte. Puede decirte qué es hermoso y por qué, basándose en lo que ha leído.

Sin embargo, la IA aún no está sintiendo como un humano. Le falta la conexión física y visceral que los humanos tienen con la belleza. Es como un crítico de música que puede describir una sinfonía perfectamente pero nunca ha escuchado una nota.

Los investigadores sugieren que si queremos que la IA entienda verdaderamente los valores humanos y la estética en el futuro, podríamos necesitar enseñarle no solo con palabras e imágenes, sino con datos sobre cómo reaccionan realmente nuestros cuerpos; algo que actualmente no podemos hacer porque la IA no tiene un cuerpo con el que reaccionar.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →