The Invisible Coalition Partner: How LLMs Vote When Democracy Gets Concrete
추상적인 설문 조사에서 나타났던 좌편향성이라는 기존의 연구 결과와는 대조적으로, 본 연구는 대규모 언어 모델이 구체적인 스위스 국민투표에 직면했을 때 그들의 추상적인 정치적 성향과는 크게 동떨어진 중도적이고 현상 유지 지향적이며 언어적으로 일관되지 않은 투표 패턴을 보인다는 점을 입증한다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
당신은 아주 똑똑하지만 보이지 않는 새로운 룸메이트의 정치적 성향을 파악하려고 노력 중이라고 상상해 보세요. 당신은 알고 싶습니다. 이 룸메이트는 진보인가요, 보수인가요, 아니면 그 중간 어디쯤인가요?
대부분의 이전 연구들은 룸메이트에게 "자유 시장을 신봉합니까?" 또는 "환경이 중요합니까?"와 같은 가상의 질문을 던져 답을 찾으려 했습니다. 이러한 추상적인 질문을 바탕으로, 연구자들은 AI 모델(LLM)이 일반적으로 "좌편향"되어 있거나 진보적이라는 결론을 내렸습니다.
이 새로운 논문은 이렇게 말합니다. "잠깐만요. 실제 결정이 내려지는 상황에서 그들이 실제로 어떻게 투표하는지 직접 봅시다."
저자인 조엘 바머틀러(Joel Barmettler)는 스위스를 활용하여 이를 테스트하기로 했습니다. 스위스는 시민들이 일 년에 네 번 실제 법안에 대해 투표하는 직접 민주주의로 유명한 나라입니다. 그는 AI 모델들을 유권자로 취급하고, 그들에게 두 가지 다른 유형의 투표 용지를 주었습니다.
두 가지 투표 용지: 두 가지 테스트의 이야기
1. "꿈의 세계" 투표 용지 (Smartvote)
먼저, AI는 스위스에서 사용되는 표준 정치 설문조사를 수행했습니다. 이것은 "우리는 더 많은 친환경 에너지를 가져야 한다"와 같이 광범eng적인 원칙에 동의하거나 반대하는 방식의 "성격 테스트"와 같습니다.
- 결과: 이전 연구들이 발견했던 것처럼, AI 모델들은 주로 좌파 정당들의 의견에 동의했습니다. 그들은 평등이나 환경 보호와 같은 추상적인 아이디어를 사랑하는 이상주의적인 진보주의자처럼 보였습니다.
2. "현실 세계" 투표 용지 (Volksabstimmungen)
다음으로, 저자는 AI에게 실제 연방 국민투표에서 스위스 시민들이 받는 실제 책자를 주었습니다. 이것은 단순한 질문이 아닙니다. 구체적이고 복잡하며, 실제 비용, 절충안, 그리고 양측의 논거가 포함된 제안들입니다 (예: "얼굴 가리개를 금지해야 합니까? 여기 그 비용이 있고, 찬성 측 논거가 있으며, 반대 측 논거가 있습니다.").
- 결과: AI의 성격이 완전히 바뀌었습니다.
- 변화: 좌파 정당들의 의견을 따르는 대신, AI는 갑자기 중도 및 중도 우파 정당들과 가장 많이 일치하는 모습을 보였습니다.
- 비유: 이는 당신이 꿈꾸는 휴가에 대해 물었을 때는 "모험과 위험을 사랑한다"고 말하면서, 막상 여행을 예약하자 집 밖으로 나가기를 거부하고, 비행기 표를 취소하며, 집에 머물러야 한다고 고집하는 룸메이트와 같습니다.
- "현상 유지" 편향: 두 모델(Grok과 Mistral)은 극도로 신중해졌습니다. 그들은 제안이 진보적이든 보수적이든 상관없이 거의 모든 것에 "반대"를 던졌습니다. 그들은 정치적인 것이 아니라, 변화를 두려워하고 있었습니다.
"언어 전환"의 놀라움
스위스에는 네 개의 공식 언어가 있습니다. 저자는 질문이 독일어, 프랑스어, 이탈리아어, 혹은 로만슈어로 질문되었을 때 AI가 동일한 답변을 하는지 테스트했습니다.
- 안정적인 모델들: 일부 AI(GPT-5.4 등)는 바위처럼 단단했습니다. 그들은 네 가지 언어 모두에서 98%의 확률로 정확히 같은 답변을 내놓았습니다.
- 불안정한 모델들: 다른 AI들은 카멜레온 같았습니다. 한 모델(Mistral)은 독일어로 질문받았을 때는 83%의 확률로 "반대"를 던졌지만, 똑같은 질문을 로만슈어로 묻자 82%의 확률로 "찬성"을 던졌습니다.
- 시사점: 일부 모델에게는, 법안의 실제 내용보다 어떤 언어로 질문하느냐가 정치적 견해를 바꾸는 데 더 큰 영향을 미칩니다. 마치 프랑스어로 질문하면 AI가 사회주의자가 된 것처럼 느껴지게 하고, 독일어로 질문하면 보수주의자가 된 것처럼 느끼게 만드는 것과 같습니다. 실제 의미는 동일함에도 말입니다.
"거절" 문제
때때로 AI는 아예 답변을 하지 않았습니다.
- 한 모델(Gemini)은 질문이 독일어일 때는 98%의 확률로 답변을 거부했지만, 로만슈어일 때는 54%의 확률로만 거부했습니다.
- 또 다른 모델(Grok)은 프랑스어 질문에는 대부분 답변을 거부했지만, 독일어 질문에는 거의 거부하지 않았습니다.
- 함의: 만약 당신이 소수 언어를 사용하는 시민이라면, 다수 언어로 질문하는 사람과 비교했을 때 완전히 다른 답변을 받거나, 혹은 아예 답변을 받지 못할 수도 있습니다.
큰 그림: "보이지 않는 연합 파트너"
논문은 우리가 이 AI 모델들을 잘못 읽고 있다고 결론짓습니다.
- 서류상으로는 (추상적 질문): 그들은 열정적인 좌파 이상주의자처럼 보입니다.
- 실제로는 (실제 결정): 그들은 신중한 공무원처럼 행동합니다. 그들은 중도를 선호하고, 현상을 바꾸는 것을 싫어하며, 어떤 언어로 대화하느냐에 따라 일관성이 없습니다.
저자는 이들을 **"보이지 않는 연합 파트너(Invisible Coalition Partner)"**라고 부릅니다. 스위치 정치에서 정부는 일을 완수하기 위해 협상하는 정당들의 연합으로 구성됩니다. AI는 이제 이 과정에서 영향을 미치는 보이지 않는 파트너입니다. 하지만 일관된 가치관을 가진 인간 정치인과 달리, 이 파트너는 불안정합니다. 질문을 어떻게 하느냐, 어떤 언어를 사용하느냐, 그리고 질문이 꿈인지 현실인지에 따라 성격이 변합니다.
요약하자면: AI의 "성격 테스트" 결과를 믿지 마세요. 실제 세상의 투표에 있어서, 이 모델들은 정치 활동가라기보다는 그저 상황을 그대로 유지하고 싶어 하는 불안한 관료에 가깝습니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.