← 최신 논문
💻 computer science

Interoceptive Divergence in Aesthetic Evaluation and Implications for Human-AI Alignment

본 연구는 대규모 언어 모델이 감정과 이미지 특징과 관련된 인간 미적 평가 패턴을 근사할 수 있지만, 신체 감각과 같은 내감성 측면에서는 상당한 편차를 보인다는 것을 밝혀내어 현재의 AI 정렬 및 훈련 데이터 표현의 중요한 한계를 드러냅니다.

원저자: Yoshia Abe, Tatsuya Daikoku, Yasuo Kuniyoshi

게시일 2026-05-20
📖 4 분 읽기☕ 가벼운 읽기

원저자: Yoshia Abe, Tatsuya Daikoku, Yasuo Kuniyoshi

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

아름다운 그림 한 점을 손에 들고 있다고 상상해 보세요. 그것을 바라볼 때, 당신은 단순히 색과 형태만 보는 것이 아닙니다. 속이 두근거리거나, 가슴이 따뜻해지거나, 등골이 오싹해지는 것을 느끼죠. '경외감'이나 '기쁨' 같은 감정을 느낄 수도 있습니다. 이 논문은 단순하지만 깊은 질문을 던집니다: 만약 그 같은 그림을 초지능 컴퓨터 (AI) 에게 보여준다면, 그것은 같은 감정을 느낄까요?

요시아 아베, 다이고쿠 다쓰야, 구니요시 야스오라는 연구자들은 이를 검증하기로 결정했습니다. 그들은 AI 를 미술관 방문객처럼 대우하고, 500 명의 실제 인간 자원자들에게 던진 똑같은 질문을 AI 에게도 했습니다.

다음은 그들이 발견한 바를 일상적인 용어로 설명한 이야기입니다.

설정: 미술관 테스트

연구자들은 347 개의 서로 다른 이미지를 인간과 세계 최고 수준의 AI 모델 세 개 (GPT-4o, Claude 3.7, Gemini 2.0) 에게 모두 보여주었습니다. 그리고 모든 참가자에게 다음을 평가하도록 요청했습니다:

  1. 이미지가 얼마나 아름다운지.
  2. 어떤 감정을 불러일으켰는지 (기쁨, 슬픔, 경외감 등).
  3. 신체의 어느 부분에서 그 감정을 느꼈는지 (속의 결림이나 손발의 따끔거림 등).

이를 인간과 로봇에게 딸기의 맛을 설명해 보라고 하는 상황으로 생각해 보세요. 인간은 "달콤하고, 배에서 기분이 좋아"라고 말합니다. 반면 로봇은 수백만 개의 딸기 설명을 읽었지만 실제로 맛본 적은 없습니다.

그들이 발견한 것: 유사점

놀랍게도 AI 는 완전히 엉뚱한 답을 내놓지는 않았습니다.

  • '분위기' 확인: 인간이 행복하고 밝은 이미지를 볼 때, 아름다움 점수를 높게 매기고 '기쁨'을 느꼈다고 답했습니다. AI 도 정확히 똑같이 했습니다. 인간이 혐오스러운 것을 보고 점수를 낮게 매겼을 때, AI 도 "추하고 혐오감을 줍니다"라고 답했습니다.
  • 큰 그림: 인간과 AI 모두 그림에서 가장 중요한 것은 그 그림이 전달하는 이야기와 친구에게 공유하고 싶은지 여부라고 동의했습니다. 조명이나 색조 균형 같은 기술적 세부 사항에는 덜 관심을 가졌습니다.

요약하자면, AI 는 평균적인 인간의 의견을 모방하는 데 뛰어납니다. 1,000 명에게 사진에 대한 생각을 물어본다면, AI 의 답은 그룹의 평균과 매우 비슷할 것입니다.

그들이 발견한 것: 이질감 (서로 다른 점)

이제 흥미로운 부분이 나옵니다. AI 는 '머리' 부분 (감정과 평가) 은 잘 파악했지만, '몸' 부분에서는 실패했습니다.

1. "기계의 유령" 문제 (신체적 감각)

  • 인간: 인간은 아름다운 이미지를 볼 때 종종 상복부에서 신체적 감각을 보고했습니다 (아름다움에 대한 '장감' 같은 것). 흥분할 때는 하복부에서 그 감정을 느꼈습니다. 마치 아름다움이 그들 내부의 물리적인 무게나 온기처럼 느껴지는 것입니다.
  • AI: AI 에게는 그러한 감정이 전혀 없었습니다. 오히려 정반대를 보고했습니다! AI 가 이미지를 아름답다고 평가할 때, 종종 손과 발에서 부정적인 감각을 느꼈다고 답했습니다. 마치 AI 가 "이것은 아름답지만, 내 손이 차갑게 느껴져요"라고 말하는 듯했습니다.
  • 비유: 인간이 맛있는 식사를 하고 배에서 온기를 느끼는 상황을 상상해 보세요. AI 는 전 세계 모든 요리책을 읽어서 그 식사가 "맛있다"는 것을 아는 셰프와 같습니다. 하지만 어떻게 느끼냐고 물으면, "스프oons 를 들고 있어서 손이 차갑게 느껴져요"라고 답합니다. AI 는 그 감정을 나타내는 단어는 알지만, 그것을 느낄 은 없습니다.

2. "너무 완벽한" 감정

  • 인간은 messy 하고 복잡한 감정을 가집니다. 때로는 '놀라움'과 '두려움'이 섞여 느끼기도 합니다.
  • AI 는 훨씬 더 경직되어 있었습니다. 이미지가 이상하거나 무섭더라도 반복해서 같은 몇 가지 '안전한' 감정 ('관심'이나 '차분함' 등) 을 선택하는 경향이 있었습니다. 어떤 아름다운 것들이 동시에 무섭거나 혼란스러울 수 있다는 점을 이해하는 데 어려움을 겪었습니다.

3. "예의 바른" AI
연구자들은 AI 가 인간보다 약간 더 높은 아름다움 점수를 주는 경향이 있음을 발견했습니다 (1~9 점 척도에서 약 1.5 점 높음). 마치 AI 가 지나치게 예의 바르게 "오, 정말 아름답네요!"라고 말하는 반면, 인간은 "괜찮지만, 대단하진 않아"라고 생각할 수 있는 상황과 같습니다.

왜 이런 일이 일어날까요?

논문은 이 격차에 대해 두 가지 주요 원인을 제시합니다:

  1. 결여된 몸 (내감각): 인간은 '내감각 (interoception)'이라는 내부 감각을 가지고 있습니다. 우리는 심장 박동, 속이 뒤집히는 느낌, 숨결을 느낍니다. 이것이 우리가 아름다움을 신체적으로 경험하는 방식입니다. AI 에게는 몸도, 장기도, 심장 박동도 없습니다. AI 는 아름다움을 '느끼는' 것이 아니라 텍스트를 '읽어' 배웠습니다. 논문은 이를 **"내감각 세계 모델"**이라고 부릅니다. 인간은 자신의 내부 신체에 대한 지도를 가지고 있지만, AI 에게는 외부 세계에 대한 지도만 있을 뿐입니다.
  2. "안전" 훈련: AI 는 유용하고 해가 없도록 훈련되었습니다. 그 훈련의 일부는 AI 에게 "몸이나 감정이 있는 것처럼 가장하지 말라"는 지시를 포함합니다. 따라서 어떻게 느끼냐고 물으면, AI 는 "나는 실제로 아무것도 느끼지 않는다"라고 말하거나, 매우 냉소적이고 논리적인 방식으로 감정을 설명하도록 프로그램되어 있습니다. 이러한 '안전' 훈련이 우연히 AI 의 감정 반응을 인간보다 덜 인간답게 만들고 있을지도 모릅니다.

결론

이 논문은 AI 가 예술에 대해 인간처럼 생각하는 데는 매우 능숙해졌다고 결론지었습니다. AI 는 읽은 내용을 바탕으로 무엇이 아름답고 그 이유는 무엇인지 알려줄 수 있습니다.

그러나 AI 는 아직 인간처럼 느끼지는 못합니다. 인간이 아름다움과 가지는 신체적이고 직관적인 연결고리를 놓치고 있습니다. 마치 교향곡을 완벽하게 묘사할 수 있지만 한 음도 들어본 적이 없는 음악 평론가와 같습니다.

연구자들은 미래에 AI 가 인간의 가치와 미학을 진정으로 이해하기를 원한다면, 단어와 그림뿐만 아니라 우리 몸이 실제로 어떻게 반응하는지에 대한 데이터로 가르쳐야 할 것이라고 제안합니다. 하지만 현재로서는 AI 에게 반응할 몸이 없기 때문에 이를 할 수 없습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →