People Are Not Just Their Countries. Disentangling Social Determinants of LLM Value Alignment Across Europe
유럽 사회 조사(European Social Survey)의 데이터를 활용한 본 연구는 사회 인구학적 요인이 유럽 전역의 거대언어모델 가치 정렬에 유의미한 영향을 미치는 한편, 응답자의 거주 국가 또한 별개의 강력한 예측 변수로 남아 있으며, 두 차원 모두 정렬 격차에 대한 상호 보완적인 통찰을 제공한다는 점을 밝히고 있다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
당신이 어떤 질문에도 답하고, 농담을 건네거나, 이야기를 쓰는 것을 도와줄 수 있는 아주 똑똑하고 모든 것을 아는 로봇 친구가 있는 세상을 상상해 보세요. 이것이 바로 오늘의 거대 언어 모델(LLM)이 작동하는 방식입니다. 이들은 우리가 매일 사용하는 챗봇과 AI 도구들의 엔진 역할을 합니다. 하지만 여기에는 함정이 있습니다. 이 로봇들은 스스로의 의견을 가지고 태어난 것이 아닙니다. 이들은 인간이 쓴 방대한 양의 책, 웹사이트, 대화들을 읽으며 모든 것을 배웁니다. 이 때문에, 그들은 그 단어들을 썼던 사람들을 닮아가기 시작합니다.
이제 '가치관'을 우리가 모두 지키며 살아가는 보이지 않는 규칙—예를 들어 무엇이 공정하다고 생각하는지, 이웃을 어떻게 대하는지, 혹은 인생에서 무엇이 중요하다고 믿는지와 같은 것들—이라고 생각해 보세요. 만약 로봇이 주로 특정한 유형의 동네에 사는 사람들에게서 배운다면, 그 로봇은 그 동네의 규칙만이 유일한 규칙이라고 생각할 수도 있습니다. 이는 매우 중요한 문제입니다. 왜냐하면 우리는 학교 과제부터 진지한 인생의 선택에 이르기까지 모든 것에 대해 이 로고들에게 조언을 구하기 시작했기 때문입니다. 만약 로봇의 '도덕적 나침반'이 특정 집단만을 향해 기울어져 있다면, 의도치 않게 다른 모든 사람을 무시하거나 오해할 수 있습니다. 과학자들은 다음과 같은 문제를 파헤치고 있습니다. 이 로봇 친구가 정말로 '당신'을 이해하고 있는 것일까요, 아니면 당신이 사는 곳이나 가족의 경제력에 기반한 특정한 버전의 '당신'만을 이해하고 있는 것일까요?
거대한 로봇 정체성 위기
이 연구에서 연구진은 가장 인기 있는 10개의 AI 챗봇을 테스트하기로 했습니다. 그들은 단순히 로봇에게 추측해보라고 시킨 것이 아니라, 유럽 사회 조사(European Social Survey)라는 거대하고 실제적인 설문조사를 제시했습니다. 이 설문조사는 29개 유럽 국가의 사람들이 삶, 돈, 종교, 그리고 정치에 대해 실제로 어떻게 생각하고 느끼는지에 대한 질문들로 가득 차 있었습니다. 연구진은 로봇의 답변을 5만 명 이상의 실제 인간의 답변과 비교했습니다.
이것은 유럽 대륙 전체를 대상으로 벌이는 거대한 '누구일까? (Guess Who?)' 게임과 같습니다. 연구진은 로봇의 답변이 인간의 답변과 일치하는지, 일치한다면 어떤 인간들과 가장 잘 맞는지 알고 싶었습니다. 로봇은 스웨덴의 대도시에 사는 부유하고 대학 교육을 받은 사람처럼 들렸을까요? 아니 아니면 불가리아의 작은 마을에 사는 은퇴한 농부처럼 들렸을까요?
로봇은 선호하는 관객이 있다
결과는 꽤 명확했습니다. 로봇에게는 확실히 선호하는 관객이 있었습니다. 연구 결과, AI 모델들은 더 부유하고, 교육 수준이 높으며, 서유럽 국가에 거주하는 사람들과 '정렬(aligning)'되는 것(즉, 동의하는 것)에 훨씬 더 능숙했습니다.
AI(DJ)가 음악을 틀고 있는 파티를 상상해 보세요. DJ는 VIP 구역에 있는 부유하고 교육 수준이 높은 손님들이 듣고 싶어 하는 곡을 정확히 알고 있는 것 같습니다. 하지만 DJ가 뒷방에 있는 손님들—소득이 낮거나, 정규 교육을 덜 받았거나, 동유럽 또는 남유럽 출신인 사람들—을 위해 노래를 틀 때면, 그 음악은 어딘가 어긋난 느낌을 줍니다. 로봇은 이러한 집단의 가치관을 이해하려고 할 때 지속적으로 정확도가 떨어졌습니다.
연구는 종교에 대해서도 살펴보았습니다. 로봇은 종교가 없거나 특정 기독교 집단에 속한 사람들을 이해하는 데 훨씬 더 뛰어났습니다. 그러나 무슬림이나 동방 정교회를 믿는 사람들을 이해하는 데는 상당한 어려움을 겪었습니다. 마치 로봇의 '문화적 사전'에서 특정 공동체를 위한 몇몇 핵심 페이지가 누락된 것과 같았습니다.
그것은 단지 당신이 어디에 사느냐의 문제가 아니다
연구진을 놀라게 한 반전이 있었습니다. 오랫동안 사람들은 단순히 누군가가 사는 '국가'만 보면 그 로봇이 그 사람에 대해 어떻게 생각할지 예측할 수 있다고 가정해 왔습니다. 당신은 "아, 내가 프랑스 출신이라면 로봇은 프랑스 사람처럼 생각하겠구나"라고 생각했을지도 모릅 height.
하지만 연구진은 더 깊이 파고들었습니다. 그들은 물었습니다. 로봇이 단순히 국가를 맞추는 것일까요, 아니면 그곳에 사는 '사람의 유형'을 맞추는 것일까요? 이를 알아내기 위해 그들은 모든 국가가 부자와 가난한 사람, 교육받은 자와 그렇지 않은 자의 비율이 정확히 동일하다고 가정하는 영리한 통계적 기법(역 확률 가중치 적용)을 사용했습니다. 만약 국가만이 유일한 변수였다면, 이 기법을 거친 후에는 국가 간의 차이가 사라졌어야 합니다.
하지만 사라지지 않았습니다. 연구진이 서류상으로 국가들을 동일하게 만들었음에도 불구하고, 로봇은 여전히 서로 다른 국가의 사람들을 다르게 대했습니다. 이는 당신이 어디에 사느냐가 당신이 누구냐만큼이나 중요하다는 것을 의미합니다. 로봇은 단순히 당신의 소득이나 직업을 보는 것이 아니라, 당신의 여권도 함께 보고 있는 것입니다. 당신이 사는 국가와 당신의 개인적 배경은 로봇이 당신을 얼마나 잘 이해하는지를 결정하는 이중 잠금 장치처럼 함께 작동합니다.
"WEIRD" 문제
이 연구는 과학자들이 "WEIRD"라고 부르는 패턴을 확인시켜 줍니다. 이는 서구적(Western), 교육받은(Educated), 산업화된(Industrialized), 부유한(Rich), 민주적인(Democratic) 사회를 의미합니다. 로봇은 이러한 묘사에 부합하는 사람들에 의해, 그리고 그들을 위해 만들어진 것처럼 보입니다. 유럽 내에서도 로봇은 "WEIRD" 모델에 부합하는 사람들에게 가장 정확했습니다.
연구진은 두 가지 유형의 질문을 테스트했습니다. 하나는 광범고 일상적인 의견(예: "당신은 정부를 신뢰합니까?")에 관한 것이었고, 다른 하나는 깊고 추상적인 인간의 가치(예: "겸손함이 중요합니까?")에 관한 것이었습니다. 그들은 광범위한 질문에 대해서는 당신이 사는 국가가 로봇의 답변 차이를 설명하는 큰 부분을 차지한다는 것을 발견했습니다. 하지만 깊고 추상적인 질문에 대해서는 국가의 영향력이 줄어들었고, 당신의 개인적 배경(예: 교육 수준)이 더 중요해졌습니다. 이는 질문을 어떻게 던지느냐에 따라 로봇이 배우는 내용이 달라진다는 것을 시사합니다.
이것이 당신에게 의미하는 바
이 연구의 핵심 결론은 로봇이 '고장 났다'거나 '나쁘다'는 것이 아닙니다. 로봇은 거울입니다. 그들은 자신들이 훈련받은 세상을 반영합니다. 만약 그 세상이 주로 부유하고 서구적이며 교육받은 배경을 가진 목소리로 구성되어 있다면, 로봇 또한 그렇게 들릴 것입니다.
연구진은 만약 당신이 독일의 대도시에 사는 석사 학위 소지자라면, 로봇이 당신을 완벽하게 이해할 가능성이 높다는 것을 발견했습니다. 하지만 당신이 유럽의 다른 지역에 있는 시골 마을의 공장 노동자라면, 로봇은 빗나갈 수 있습니다. 이것은 단순한 작은 오류가 아닙니다. 이는 우리가 AI로부터 조언을 얻는 데 점점 더 의존하게 됨에 따라, 이미 가장 강력한 권력을 가진 사람들의 가치를 의도치 않게 강화하고, 다른 모든 사람들을 뒤처지게 만들 수 있음을 의미합니다.
이 논문은 AI 사용을 중단해야 한다고 말하는 것이 아닙니다. 대신, 우리가 이러한 도구들을 어떻게 만들고 테스트해야 하는지에 대해 훨씬 더 주의를 기울여야 한다고 제안합니다. 우리는 단순히 "이 로봇은 유럽과 정렬되어 있다"라고 말해서는 안 됩니다. 우리는 "어떤 유럽인들과 정렬되어 있는가?"라고 물어야 합니다. 왜냐하면 이 연구가 보여주듯, 사람들은 단지 그들의 국가가 전부가 아니며, 로봇 또한 그들을 그렇게 취급해서는 안 되기 때문입니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.