← 최신 논문
💻 computer science

Assessing How Hate, Counterspeech, and Toxicity Affect Hate Group Newcomers

이 논문은 Reddit 의 104 개 혐오 커뮤니티에서 16,513 명의 신참을 분석한 결과, 혐오 발언에 대한 반박 (counterspeech) 이 사용자의 지속적 참여를 줄이는 데 효과적이지만 반박 자체의 독성 수준은 일반 대화보다 높으며, 이는 혐오 사용자의 추가적 적대감을 유발할 수 있음을 밝혔습니다.

원저자: Daniel Hickey, Matheus Schmitz, Daniel M. T. Fessler, Paul E. Smaldino, Kristina Lerman, Goran Murić, Keith Burghardt

게시일 2026-04-13
📖 3 분 읽기☕ 가벼운 읽기

원저자: Daniel Hickey, Matheus Schmitz, Daniel M. T. Fessler, Paul E. Smaldino, Kristina Lerman, Goran Murić, Keith Burghardt

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

🎭 핵심 비유: "악성 커뮤니티의 문지기"

상상해 보세요. 어떤 마을 (혐오 그룹) 에 새로 온 사람 (신입) 이 있습니다. 이 마을 사람들은 서로를 칭찬하며 악한 말을 주고받습니다. 이때, 마을 밖에서 온 사람들이 "그건 틀렸어!"라고 소리치며 반박합니다. 이것이 바로 **'카운터스피치 (Counterspeech, 반박 메시지)'**입니다.

연구자들은 이 반박 메시지가 두 가지 종류일 수 있다고 가정했습니다.

  1. 친절한 반박: "그 말은 틀렸고, 우리 모두는 평등해야 해요." (비독성)
  2. 독한 반박: "너희는 멍청하고, 인종차별주의자야!" (독성/공격적)

연구의 목적은 이 두 가지 반박이 신입들에게 어떤 영향을 미치는지 확인하는 것이었습니다.


🔍 주요 발견 사항 3 가지

1. 반박 메시지도 꽤나 "독"이 있습니다 (RQ1)

우리는 보통 반박 메시지를 "착한 말"로 생각하지만, 연구 결과는 놀라웠습니다.

  • 비유: 혐오 그룹 안에서 서로 악담을 주고받는 것은 마치 매운 고추를 씹는 것과 같습니다. 그런데 반박을 하는 사람들은 그 고추를 씹는 것보다 **훨씬 더 매운 고추 (약 2 배 더 독함)**를 씹고 있었습니다.
  • 사실: 반박 메시지는 혐오 발언 자체보다는 덜 독하지만, 일반적인 대화에 비해 훨씬 공격적이고 독했습니다. 특히, 반박을 할 때 상대방의 혐오적인 말을 인용하거나 욕설을 언급하는 경우가 많아서 AI 가 이를 '독성'으로 판단한 것입니다.

2. 반박 메시지는 신입을 쫓아냅니다 (RQ2)

가장 중요한 발견은 반박 메시지가 실제로 효과가 있었다는 점입니다.

  • 비유: 새로운 사람이 마을에 들어와서 악담을 퍼붓는데, 누군가 "이건 안 돼!"라고 반박하면, 그 신입은 **"이 마을은 내게 맞지 않는구나"**라고 생각하고 떠나버립니다.
  • 결과: 반박 메시지를 받은 신입들은 그 혐오 그룹에서 계속 활동할 확률이 낮아졌습니다. 반대로, 다른 혐오 그룹 회원들이 "좋아! 잘했어!"라고 응원해 주면, 신입은 더 열심히 활동하게 됩니다.
  • 해석: 이는 신입들이 아직 그 사상에 깊이 빠지지 않은 상태라, 조금만 반대 의견을 들어도 쉽게 마음을 바꾸거나 흥미를 잃을 수 있음을 시사합니다.

3. 독한 반박은 '악순환'을 부릅니다 (RQ2 - 독성 영향)

그런데 여기서 중요한 뉘앙스가 있습니다.

  • 비유: 독한 반박을 하면 신입이 떠나는 속도는 비독성 반박과 비슷했습니다. 하지만 독한 반박을 하면, 그 마을의 기존 회원들이 더 화를 내며 "너희는 우리 편이 아니야!"라고 더 공격적으로 반응합니다.
  • 결과: 독한 반박은 신입을 쫓아내는 데는 도움이 되지만, 그 과정에서 그 커뮤니티 내부의 싸움을 더 격화시킵니다. 마치 불에 기름을 끼얹는 격입니다.

💡 이 연구가 우리에게 주는 교훈

이 연구는 온라인 혐오를 막기 위해 우리가 무엇을 해야 하는지 두 가지 중요한 점을 알려줍니다.

  1. "착한 반박"이 더 낫다:
    반박을 할 때 화를 내거나 독하게 말하면, 상대방을 쫓아낼 수는 있지만 커뮤니티 전체를 더 시끄럽고 독하게 만듭니다. 대신 차분하고 논리적인 반박이 신입을 설득하고 떠날 수 있게 하는 가장 좋은 방법입니다.

  2. 신입은 아직 '진짜'가 아니다:
    혐오 그룹에 막 들어온 사람들은 아직 그 사상에 깊이 빠지지 않은 '호기심 많은 관광객'일 가능성이 높습니다. 이들에게는 반박이 매우 효과적입니다. 하지만 이미 그 그룹에 오래 산 사람들은 반박에 무뎌져서 효과가 없을 수 있습니다. 따라서 초기 단계의 신입들을 잡는 것이 가장 중요하다는 뜻입니다.

📝 한 줄 요약

"온라인 혐오 그룹에 새로 온 사람들에게 독한 말로 반박하면 그들이 떠날 수는 있지만, 그 과정에서 싸움이 더 커집니다. 대신 차분하고 논리적인 반박으로 신입들을 설득하는 것이 온라인 환경을 깨끗하게 만드는 지름길입니다."

이 연구는 단순히 "반박하자"는 것을 넘어, **"어떻게 반박할 것인가 (독하지 않게)"**에 대한 전략적 중요성을 강조합니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →