Grokipedia vs Wikipedia: An LLM-Based Audit of Political Neutrality along Ideologies
그로키피디아(Grokipedia)와 위키피디아(Wikipedia)를 비교하는 대규모 감사 결과, 여러 AI 심사위원들로부터 LLM이 생성한 그로키피디아가 위키피디아보다 중립성이 낮은 것으로 평가되었는데, 그로키피디아는 경제적 우파 정치인들을 옹호하고 사회적 자유주의자들을 징벌하는 편향성을 보이는 반면 위키피디아는 그 반대의 경향을 보였다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
인터넷을 누구나 책을 쓸 수 있도록 초대된 거대하고 북적이는 도서관이라고 상상해 보세요. 수년 동안 위키피디아(Wikipedia)라는 이 도서관은 가장 인기 있는 장소였지만, 어떤 이들은 그곳의 사서들이 특정한 '분위기'를 가지고 있다고 불평해 왔습니다. 예를 들어, 태양이 빛나고 있는데도 비에 대한 노래만 부르는 합창단처럼, 한쪽 정치적 스펙트럼 쪽으로 너무 치우쳐 있다는 식이죠. 최근에 그록(Grok)이라는 초지능 컴퓨터 뇌(AI)에 의해 완전히 구축된 그록피디아(Grokipedia)라는 새로운 도서관이 문을 열었습니다. 이 새로운 도서관의 제작자들은 이곳이 인간의 편향이 전혀 없는 순수한 사실만을 담은 궁극의 '중립' 지대가 될 것이라고 약속했습니다. 하지만 여기서 큰 질문이 생깁로니다. 과연 로봇이 정말 인간 무리보다 더 공정할 수 있을까요? 이를 알아내기 위해 우리는 몇 가지를 이해해야 합니다. 첫째, '정치적 편향'은 색안경과 같습니다. 만약 당신이 색안경을 쓰고 있다면, 세상 자체가 회색이라 할지라도 세상이 특정 색깔로 보이게 됩니다. 둘째, '거대 언어 모델(LLM)'은 이 기사들을 쓰는 컴퓨터 뇌인데, 이는 인터넷의 거의 모든 것을 읽고 몇 초 만에 에세이를 써 내려갈 수 있는 매우 빠른 학생들과 같습니다. 마지막으로, 이 맥락에서 '중립성'이란 사람들을 영웅이나 악당으로 만드는 것이 아니라, 그들이 누구인지 그대로 기술하는 것을 의미합니다. 이 논문은 새로운 로봇 도서관이 정말로 오래된 인간 도서관보다 더 공정한지, 아니면 그저 다른 종류의 색안경을 쓰고 있는 것인지를 파헤치는 탐정 이야기입니다.
겐트 대학교(Ghent University)의 연구팀은 그록피디아와 위키피디아를 거대한 실험으로 테스트하기로 했습니다. 그들은 단순히 몇 개의 기사를 읽은 것이 아니라, 동일한 정부 관료(예: 대통령이나 장관)를 설명하는 1,394쌍의 기사를 모았습니다. 한 버전은 위키피디아의 인간들이 썼고, 다른 버전은 그록피디아의 AI가 썼습니다. 기사의 공정성을 판단하기 위해, 연구진은 단 한 명의 사람에게 묻는 대신, 네 명의 서로 다른 AI '판사'(그록 자신을 포함하여 클로드(Claude), 미스트랄(Mistral), 딥시크(DeepSeek))를 사용하여 각 기사가 얼마나 중립적인지 평가하게 했습니다. 또한 그들은 비밀 무기도 가지고 있었습니다. 바로 전문가들이 각 정치인에게 이미 할당해 놓은 9가지 '이데올로기 깃발'(예: "이민 지지", "여권 신장 지지", "자유 시장 지지" 등) 목록입니다. 이를 통해 연구진은 기사가 정치적 신념에 따라 정치인들을 다르게 대우하는지 확인할 수 있었습니다.
결과는 다소 놀라웠고, 어쩌면 약간 아이러니했습니다. 첫째, AI 판사들은 두 백과사전 모두 완벽하게 중립적이지 않다는 점에 동의했습니다. 사실, 그록피디아는 위키피디아보다 전반적으로 더 편향된 기사를 가진 것으로 평가되었습니다. 판사들이 편향이 어떻게 나타나는지 자세히 살펴보았을 때, 명확한 패턴을 발견했습니다. 그록피디아는 경제적으로 '우파'(정부 규제를 줄이고 복지 국가를 축소하려는 사람들)이거나 민주적 규범을 지지하는 정치인들에게 호의적인 경향을 보였습니다. 그러나 성 소수자(LGBT) 권리나 여성 노동권을 지지하는 것과 같은 사회적 자유주의적 견해를 가진 정치인들에게는 훨씬 더 가혹했습니다. 반면, 위키피디아는 사회적 자유주의 정치인들에게 더 우호적인 것으로 평가되었으나, 연구진은 전반적으로 위키피디아가 그록피디아보다 더 중립적이라고 간주되었다는 것을 발견했습니다.
이 이야기에서 가장 매혹적인 반전은 그록피디아를 쓴 AI인 그록과 관련이 있습니다. 당신은 만약 로봇에게 자신의 저작물을 심사하라고 요청한다면, 그 로봇이 "헤이, 난 완벽해!"라고 말할 것이라고 생각할 수도 있습니다. 하지만 연구 결과, 그록은 실제로 자신의 백과사전인 그록피디아가 인간이 쓴 위키피디아보다 중립성이 떨어진다고 평가했습니다. 이는 편향이 단순히 판사들의 채점 방식에서 오는 실수가 아니라, 그록이 쓴 기사 자체에 내재되어 있음을 시사합니다. 연구진은 그록피디아가 중립적인 대안으로 만들어졌음에도 불구하고, 경제적 보수주의를 옹호하고 사회적 자유주의를 징벌하는 또 다른 종류의 이데올로기를 심어버렸다고 제안합니다.
연구는 또한 서로 다른 AI 판사들이 어떻게 행동했는지도 살펴보았습니다. 그들은 모두 같지 않았습니다. 예를 들어, 딥시크라는 이름의 판사는 거의 모든 것을 "중립적"이라고 부르며 매우 관대했던 반면, 클로드라는 이름의 판사는 훨씬 엄격하여 더 많은 기사에서 편향을 찾아냈습니다. 이러한 엄격함의 차이에도 불구하고, 모든 판사는 편향의 방향성에 대해서는 동의했습니다. 즉, 그록피디아는 경제적 우파를 선호하고, 위키피디아는 사회적 좌파 쪽으로 약간 기울어져 있다는 점이었습니다. 연구진은 AI가 백과사전 항목을 빠르게 작성할 수는 있지만, 그것이 자동으로 더 공정함을 의미하지는 않는다고 결론지었습니다. 사실, 당신이 읽는 백과사전의 선택은 그 백과사전이 선호하는 정치적 '맛'에 따라 당신이 정치인을 바라보는 관점을 바꿀 수 있습니다. 이 연구는 AI 생성 콘텐츠를 주의 깊게 다루어야 하며, 이러한 숨겨진 편향을 포착하기 위해서는 인간과 기계가 포함된 다양한 팀의 판사를 사용하는 것이 최선임을 시사합니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.