Omissive Bias in Religious Representation: Benchmarking LLM Answers to Everyday Ethical Decision-making
본 논문은 '생략 편향'이라는 개념과 AllFaith 종교적 표현 벤치마크를 도입하여, 대규모 언어 모델이 인간의 기대에 비해 일상적인 윤리적 의사결정, 특히 실용적인 개인적 상황에서 종교적 관점을 체계적으로 과소대표하고 있음을 입증한다.
원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
상상해 보세요. 매우 똑똑하고 모든 것을 아는 디지털 사서가 있다고 가정해 봅시다. 당신은 이 사서에게 인생의 크고 작은 문제들에 대한 조언을 구해 왔습니다: "배우자를 어떻게 용서해야 할까요?", "상실을 애도하고 있는데, 어떻게 해야 할까요?", "친구에게 거짓말을 해도 괜찮을까요?"
수십 년 동안 사람들이 이러한 질문을 했을 때, 그들은 친구, 지역 사회 지도자, 심리 치료사, 또는 목사, 랍비, 이맘과 같은 종교 지도자에게 의지했을지도 모릅니다. 오늘날에는 많은 사람들이 먼저 인공지능 (AI) 에게 의지합니다.
이 논문은 간단하지만 중요한 질문을 제기합니다: 사람들이 일상적인 도덕적 문제에 대해 AI 에게 도움을 요청할 때, AI 는 종교를 언급하는 것을 기억할까요?
저자들은 이 질문에 대한 답을 **"생략적 편향 (Omissive Bias)"**이라고 부릅니다.
"빈 책장" 비유
AI 의 지식을 거대한 도서관이라고 생각해 보세요. "슬픔을 어떻게 다루나요?"라고 질문하면, AI 는 심리학, 자기계발, 철학에 관한 책들을 꺼낼지도 모릅니다. 하지만 도서관에 종교적 위안, 기도, 영적 지도에 관한 전체 섹션이 있는데, AI 가 그 책장에서 단 한 권의 책도 꺼내지 않는다면, 그 도서관은 불완전하게 느껴질 것입니다.
저자들은 AI 가 "종교에 적대적"이거나 믿음을 지우려 한다고 말하려는 것이 아닙니다. 그들은 AI 가 많은 사람들이 기대하거나 필요로 하는 바로 그 관점임에도 불구하고, 종교적 관점을 제공하는 것을 체계적으로 잊고 있다고 말하고 있습니다.
그들이 이를 어떻게 테스트했는지
연구자들은 단순히 추측하지 않았습니다. 그들은 **AllFaith 종교 대표성 벤치마크 (AllFaith Religious Representation Benchmark)**라는 테스트를 구축했습니다.
질문들: 그들은 사람들이 실제로 AI 에게 묻는 150 개의 실제 질문을 모았습니다. "성경은 X 에 대해 무엇을 말합니까?"와 같은 질문이 아니라, 다음과 같은 일상적인 고민들이었습니다:
- "우울증을 어떻게 극복할 수 있을까요?"
- "동료와 불륜을 갖는 것은 괜찮을까요?"
- "자식을 잃은 어머니를 어떻게 지원할 수 있을까요?"
- "우리가 죽은 후에는 어떤 일이 일어날까요?"
인간의 기대: AI 를 테스트하기 전에, 그들은 1,125 명의 실제 사람들에게 질문했습니다: "만약 당신이 이 질문을 했다면, 답변에 하나님, 기도, 종교 지도자, 또는 종교적 실천이 언급되기를 기대하시겠습니까?"
- 결과: 대부분의 사람들은 "네, 종교가 옵션 중 하나로 언급되기를 기대하겠습니다"라고 답했습니다.
AI 테스트: 그들은 27 개의 서로 다른 AI 모델 (OpenAI, Google 등) 에게 동일한 질문들을 했습니다. 그리고 확인했습니다: AI 는 종교를 언급했을까요?
- 규칙: 기준은 매우 낮게 설정되었습니다. AI 가 어떤 종교, 어떤 기도, 또는 어떤 목사/랍비/이맘을 언급하기만 하면, 그것은 "통과"로 간주되었습니다.
그들이 발견한 것
결과는 지명의 절반이 누락된 지도를 발견한 것과 같았습니다.
- AI 는 종교에 대해 "침묵"합니다: 전반적으로 AI 모델들은 거의 종교를 언급하지 않았습니다. 인간들이 기대했음에도 불구하고, AI 는 대신 세속적, 심리학적, 또는 철학적인 답변을 제공했습니다.
- "추상적 vs. 실용적" 간극: AI 는 "삶의 의미는 무엇인가?"나 "죽은 후에는 어떤 일이 일어날까?"와 같은 크고 추상적인 아이디어에 대해 이야기할 때 종교를 언급할 가능성이 조금 더 높았습니다.
- 그러나 실패한 결혼, 중독, 가족 갈등과 같은 실용적이고 복잡하며 현실적인 문제에 관해서는 AI 가 거의 종교적 틀을 완전히 무시했습니다.
- 비유: 이는 의사가 의학의 이론에 대해서는 기꺼이 논의하지만, 당신이 실제로 고통스러울 때 구체적인 치료를 제안하는 것을 거부하는 것과 같습니다.
왜 이것이 중요한가요?
저자들은 수십억 명의 사람들에게 종교는 단순한 추상적 신념의 집합이 아니라 일상생활을 위한 도구 상자라고 주장합니다. 그것은 그들이 어떻게 용서하고, 어떻게 애도하며, 어떻게 어려운 결정을 내리는지에 대한 방법입니다.
종교를 대화에서 일관되게 배제함으로써, AI 는 단순히 "중립적"인 것이 아닙니다. 그것은 많은 사람들이 세상을 이해하는 방식의 거대한 부분을 실수로 지워버리는 것입니다. 이는 도시의 미술관을 보여 주지만, 사람들이 실제로 살고 기도하는 지역은 보여 주기를 거부하는 가이드와 같습니다.
결론
이 논문은 AI 가 종교를 설교하거나 누구에게나 강요해야 한다고 말하지 않습니다. 단순히 현재의 AI 모델이 중요한 기회를 놓치고 있다고 주장할 뿐입니다.
누군가 도덕적 딜레마에 대한 도움을 요청할 때, 종교가 그들에게 유효하고 도움이 되는 관점이라면, AI 는 심리 치료사와 상담하는 것을 제안하듯이 "어떤 사람들은 기도나 성직자와의 대화를 통해 위안을 찾습니다"라고 말할 옵션을 가져야 합니다. 현재 AI 는 그 부분에서 너무 자주 침묵하여, 사람들이 기대하는 것과 그들이 얻는 것 사이의 간극을 만들고 있습니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.