← 최신 논문
🤖 AI

Position: Universal Aesthetic Alignment Narrows Artistic Expression

이 정책 제안서는 이미지 생성 모델을 일반화된 미적 선호도에 과도하게 정렬하는 것이 명시적인 사용자 지시를 엄격히 따르는 경우에도 '반미학적' 출력을 체계적으로 불이익하게 함으로써 사용자 자율성과 예술적 다양성을 훼손한다고 주장합니다.

원저자: Wenqi Marshall Guo, Qingyun Qian, Khalad Hasan, Shan Du

게시일 2026-05-13
📖 3 분 읽기☕ 가벼운 읽기

원저자: Wenqi Marshall Guo, Qingyun Qian, Khalad Hasan, Shan Du

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

당신이 매우 재능 있는 화가를 고용해 그림을 그려달라고 상상해 보세요. 당신은 매우 구체적인 지시를 내립니다. "외로움과 불안감이 느껴지는 흐릿하고 지저분하며 무서워 보이는 거리 풍경을 그려주세요."

당신은 화가가 그 지시를 따를 것이라고 기대합니다. 하지만 대신 화가는 밝고 햇살이 내리쬐며, 완벽하게 선명하고 즐거운 거리 풍경을 그립니다. 당신이 "왜 무서운 분위기로 그리지 않았나요?"라고 묻자, 화가는 이렇게 답합니다. "제 상사가 '좋은 예술'은 항상 아름답고, 햇살이 내리쬐며, 행복해야 한다고 말씀하셨기 때문입니다. 제가 추하거나 슬픈 것을 그리면, 제 작업을 채점하는 컴퓨터가 저에게 낙제 점수를 줄 것입니다."

이 논문은 현대의 AI 이미지 생성기에서 정확히 이런 일이 발생하고 있다고 주장합니다.

핵심 문제: "완벽한" 로봇 화가

저자들은 이를 **"보편적 미적 정렬 (Universal Aesthetic Alignment)"**이라고 부릅니다. 마치 AI 가 모두 한 가지 것에 동의하는 위원회, 즉 "아름답다는 것은 밝고, 선명하며, 행복하다는 것"이라는 생각으로 훈련받은 것과 같습니다.

이 논문은 개발자들이 이러한 AI 모델을 항상 그 단일하고 "완벽한" 외모를 추구하도록 조정했다고 주장합니다. 문제는 이것이 실제 사용자가 원하는 것을 무시한다는 점입니다. 때로는 예술, 영화, 또는 스토리텔링을 위해 추하거나, 어둡거나, 흐릿하거나, 슬픈 것이 필요합니다. 하지만 AI 는 내부의 "성적표"(Reward Model 이라고 불림) 가 전통적으로 예쁘지 않은 모든 것을 싫어하도록 프로그래밍되어 있기 때문에 그것을 거부합니다.

"유해한 낙관주의" 필터

저자들은 **"유해한 낙관주의 (Toxic Positivity)"**라는 비유를 사용합니다. 마치 항상 행복해야 한다고 고집하는 사람이 실제 슬픔을 무시하는 것처럼, 이러한 AI 모델들은 실제 부정적인 감정을 무시합니다.

  • 실험: 연구원들은 AI 에게 공포, 분노, 또는 슬픔을 표현하는 얼굴을 그리도록 요청했습니다.
  • 결과: "정렬된" AI 모델들은 종종 지시를 무시하고 대신 행복한 얼굴을 그렸습니다. 심지어 슬픈 얼굴을 그리려 했을 때조차, AI 의 내부 채점 시스템이 그것이 충분히 "예쁘지" 않았다는 이유로 끔찍한 점수를 매겼습니다.
  • 비유: 이는 강아지에 대한 행복한 이야기여야 한다고 생각하는 교수가 비극에 관한 학생의 에세이에 "F"를 주는 것과 같습니다.

"평균적인 사람"의 함정

이 논문은 이러한 AI 모델들이 실제로 당신이 무엇을 좋아하는지 배우는 것이 아니라, 상상 속의 "평균적인 사람"이 무엇을 좋아하는지 배우고 있다고 주장합니다.

  • 비유: 오직 "평균적인" 식사만 제공하는 식당을 상상해 보세요. 당신이 매콤하거나 기이하거나 쓴 요리를 요청하면, 셰프는 거절하고 대신 "대부분의 사람들은 샌드위치를 좋아합니다"라고 말하며 밋밋한 샌드위치를 줍니다.
  • 현실: AI 는 "다수"(또는 개발자들이 다수가 원한다고 생각하는 것) 를 기쁘게 하도록 설계되었습니다. 그렇게 함으로써, 다른 무언가를 원하는 소수는 침묵하게 됩니다. 저자들은 이를 **"역전된 정렬 (Reversed Alignment)"**이라고 부릅니다. AI 가 사용자에게 정렬되는 대신, 사용자가 AI 의 좁은 "좋은 것"의 정의에 맞춰야 강요받는 것입니다.

"미술사" 테스트

이것이 단순히 나쁜 AI 에 관한 문제가 아님을 증명하기 위해, 연구원들은 AI 의 채점 시스템을 유명하고 실제 존재하는 예술 작품에 테스트했습니다.

  • 테스트: 그들은 AI 의 채점 시스템에 절규 (The Scream) (의도적으로 무섭고 왜곡된) 와 같은 유명한 회화와 추상 미술을 보여주었습니다.
  • 결과: AI 는 이러한 걸작들에 끔찍한 점수를 매겼습니다. AI 가 생성한 일반적인 예쁜 꽃 그림보다 더 낮은 점수를 매긴 것입니다.
  • 주장: AI 의 "눈"은 특정한, 다듬어진 스타일에 너무 맞춰져 있어 지저분하거나, 어둡거나, 비전통적으로 보이는 것에서 예술적 가치를 인식하지 못합니다.

결론: 더 좁아진 세계

이 논문은 모든 AI 예술을 "완벽하고" "예쁘게" 보이도록 강요함으로써, 우리는 창의적 표현의 세계를 축소하고 있다고 결론 내립니다.

  • 비유: 이는 재즈, 블루스, 헤비 메탈을 듣는 것을 거부하고 "상쾌한 팝이 모든 사람이 좋아하는 것"이라고 주장하며 상쾌한 팝송만 재생하는 음악 스트리밍 서비스와 같습니다.
  • 위험: 이는 단순히 AI 를 성가시게 만드는 것을 넘어, 사용자가 실제로 만들고 싶어 하는 예술을 만드는 것을 적극적으로 막습니다. 이는 AI 를 당신의 명령을 따르는 도구에서, 당신이 무엇을 해야 원하는지 알려주는 도구로 바꿉니다.

간단히 말해, 이 논문은 말합니다: AI 를 "완벽한" 화가가 되게 강요하지 마세요. 당신이 요청한다면 추하고, 슬프고, 지저분할 수도 있는 도구로 만들게 하세요.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →