← 최신 논문
💻 computer science

Unpacking the Eye of the Beholder: Social Location, Identity, and the Moving Target of Political Perspectives

본 논문은 82,000 건 이상의 평가를 기반으로 훈련되어 다양한 정치적·사회적 정체성이 시각 콘텐츠를 어떻게 해석하는지 예측하는 도구인 관점주의 시각적 정치적 감정 (PVPS) 분류기를 소개하며, 이를 통해 정치적 이미지의 주관적이고 가변적인 의미를 정확하게 측정하기 위해서는 청중의 정체성을 고려하는 것이 필수적임을 입증한다.

원저자: Elena Sirotkina

게시일 2026-05-13
📖 4 분 읽기☕ 가벼운 읽기

원저자: Elena Sirotkina

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

이 논문은 쉬운 언어와 일상적인 비유를 사용하여 설명합니다.

핵심 아이디어: "일률적 적용"의 오류

가상의 상황을 상상해 보세요. 방 안에 가득 찬 사람들에게 시위 사진을 보여줍니다. 과거의 컴퓨터 과학자들은 그 사진을 보고 "분노"나 "폭력성"이 얼마나 느껴지는지 단 하나의 점수를 부여하는 기계를 만들려고 시도했습니다. 기계가 그 사진을 "폭력적"이라고 판단하면, 방 안의 모든 사람이 동의할 것이라고 가정했던 것입니다.

이 논문의 저자, 엘레나 시로트키나 (Elena Sirotkina) 는 이렇게 말합니다: "아니요, 그것은 틀렸습니다."

그녀는 정치적 사진들이 로르샤흐 잉크반점 검사와 같다고 주장합니다. 잉크반점에서 무엇을 보느냐는 전적으로 보는 사람의 정체성에 달려 있습니다. 시위 사진은 민주당원에게는 "영웅적인 저항"으로 보일 수 있지만, 공화당원에게는 "위험한 혼란"으로 보일 수 있습니다. 경찰관 사진은 어떤 집단에게는 "안전"으로, 다른 집단에게는 "억압"으로 비칠 수 있습니다.

기존의 컴퓨터 도구는 이러한 다양한 의견들을 모두 취해 평균을 내고, 그 결과를 "진실"이라고 부르는 실수를 저지릅니다. 저자는 이는 마치 빨간 물감과 파란 물감을 섞어 "보라색"이라고 부른 뒤, 원래의 빨간색과 파란색이 존재하지 않았던 것처럼 가장하는 것과 같다고 말합니다. 정치에서 의견 불일치 자체가 핵심입니다.

해결책: "관점주의적" 카메라

이를 해결하기 위해 저자는 PVPS(Perspectivist Visual Political Sentiment, 관점주의적 시각적 정치 정서) 라는 새로운 도구를 개발했습니다.

기존의 표준 카메라를 단순히 인원을 세는 경비원이라고 생각해 보세요. 그것은 군중을 보고 "여기에 50 명이 있다"고 말합니다.

반면 PVPS 도구는 초능력을 가진 탐정과 같습니다. 단순히 사진을 보는 것을 넘어, **"누가 이 사진을 보고 있으며, 그들은 어떻게 느낄 것인가?"**라고 묻습니다.

단 하나의 점수를 주는 대신, PVPS 는 프로파일을 제공합니다. 다음과 같이 알려줍니다:

  • "젊고 자유주의적인 여성이 이 사진을 보면 열광할 것입니다."
  • "나이가 많고 보수적인 남성이 이 사진을 보면 두려워할 것입니다."
  • "히스패닉계 민주당원이 이 사진을 보면 희망을 느낄 것입니다."

이 도구는 정치적 이미지를 보고 자신의 감정을 표현한 5,575 명의 실제 미국 성인이 제공한 약 82,000 개의 평가를 분석하여 이러한 패턴을 학습했습니다. 컴퓨터는 주먹을 쥔 모습, 경찰 제복, 특정 국기 같은 구체적인 시각적 단서들이 사람마다 다른 감정을 유발한다는 것을 학습했습니다.

작동 원리 (레시피)

저자는 단순히 챗봇에게 추측을 요청한 것이 아닙니다. 그녀는 두 가지 요소를 결합한 시스템을 구축했습니다:

  1. 사진이 어떻게 보이는지: AI 를 사용하여 물체, 색상, 형태 (예: 들어 올려진 주먹이나 경찰차) 를 인식합니다.
  2. 누가 보고 있는지: 해당 사람의 정체성 (정당, 나이, 성별, 학력) 에 대한 데이터를 활용합니다.

이 시스템은 시각적 단서가 방아쇠 역할을 한다는 것을 학습했습니다. 예를 들어, 시위 사진에서 "경찰차"를 보는 것은 한 집단에게는 "두려움" 반응을, 다른 집단에게는 "안전" 반응을 유발할 수 있습니다. 컴퓨터는 이러한 시각적 단서만으로 사람들의 반응을 예측하는 법을 배웠습니다.

발견한 사실 ("아하!" 순간들)

저자는 이 새로운 도구를 두 가지 유명한 연구에 적용하여 결론이 어떻게 바뀌는지 확인했습니다.

1. "감정" 실험
이전 연구는 'Black Lives Matter(BLM)' 사진을 분석하여 "열광"이 사람들이 사진을 공유하는 데 도움이 된다는 사실을 발견했습니다.

  • 기존 관점: "열광은 공유에 유리하다."
  • PVPS 관점: 더 복잡합니다. 열광은 민주당 여성들이 사진을 더 많이 공유하게 만듭니다. 하지만 공화당 남성들에게는 "두려움"과 "혐오"가 사진을 공유하게 만드는 요인입니다.
  • 교훈: 같은 감정 (열광) 이 모든 사람에게 작동하는 것은 아닙니다. 사진이 시청자의 정체성과 일치할 때만 작동합니다.

2. "폭력성" 실험
다른 연구는 시위 사진을 보고 "어떤 것이 폭력적으로 보이는가?"라고 물었습니다. 그 결과, 불이나 경찰이 포함된 사진이 폭력적으로 보인다는 사실을 발견했습니다.

  • 기존 관점: "불과 경찰 = 폭력적이다."
  • PVPS 관점: 원래 연구자들이 "폭력적"이라고 판단한 사진들은 실제로 공화당원과 보수주의자들이 "호의적"이거나 "지지적"이라고 평가한 사진들과 정확히 일치했습니다.
  • 교훈: 중립적인 관찰자에게는 "폭력성"으로 보이는 것이 종종 특정 집단 (이 경우 보수주의자들) 이 이미지를 좋아한다는 신호일 뿐입니다. "폭력성"은 사진 속에 있는 것이 아니라, 보는 사람의 눈에 있는 것입니다.

결론

이 논문은 정치적 이미지들이 움직이는 표적이라고 결론 내립니다. 누가 그것을 보고 있는지를 알지 못하면 사진이 무엇을 "의미"하는지 측정할 수 없습니다.

정치적 소통을 이해하려면 단순히 "이 사진이 폭력적인가?"라고 묻는 것으로는 부족합니다. "이 사진이 민주당원에게 폭력적인가? 공화당원에게 폭력적인가?"라고 물어야 합니다.

저자의 도구인 PVPS 는 추측을 멈추고, 사람들이 보는 사진에 기반하여 서로 다른 집단이 동일한 세상을 어떻게 다르게 보는지 정확하게 측정할 수 있게 해줍니다. 이는 의견 불일치라는 "소음"을 유용한 데이터로 변환합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →