← 최신 논문
💻 computer science

From Birdwatch to Community Notes, from Twitter to X: four years of community-based content moderation

본 논문은 X의 커뮤니티 노트(구 버드워치) 프로그램에 대한 4년간의 포괄적인 기술적 분석을 제시하며, 언어적 다양성, 출처 활용 관행, 기여자 활동 및 상호작용 네트워크를 조사하는 동시에 커뮤니티 기반 콘텐츠 중재에 관한 연구를 진전시키기 위해 선별된 데이터셋과 코드를 공개한다.

원저자: Saeedeh Mohammadi, Narges Chinichian, Hannah Doyal, Anna Bertani, Kristina Skutilova, Hao Cui, Michele d'Errico, Siobhan Grayson, Taha Yasseri

게시일 2026-06-15
📖 4 분 읽기☕ 가벼운 읽기

원저자: Saeedeh Mohammadi, Narges Chinichian, Hannah Doyal, Anna Bertani, Kristina Skutilova, Hao Cui, Michele d'Errico, Siobhan Grayson, Taha Yasseri

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

소셜 미디어를 수백만 명의 사람들이 매초마다 자신의 생각을 외쳐대는 거대하고 혼란스러운 광장이라고 상상해 보세요. 때때로 사람들은 거짓말, 루머, 혹은 혼란스러운 이야기를 외칩니다. 과거에는 소수의 "경비병"(전문가)이나 "로봇 스캐너"(AI)가 모든 사람의 말을 듣고 나쁜 것들을 표시하려고 노력했습니다. 하지만 외치는 사람들이 너무 많아서 경비병들이 따라잡을 수 없었고, 로봇 스캐너는 편향된 데이터로 학습되었기 때문에 종종 실수를 저질렀습니다.

이 문제를 해결하기 위해, X(구 트위터)는 커뮤니티 노트(원래 이름은 '버드워치')라는 새로운 아이디어를 출시했습니다. 이것을 일반 시민들이 광장을 감시하는 데 참여하도록 초대받는 이웃 방범대 프로그램이라고 생각해 보세요.

이 논문은 이 이웃 방범대가 첫 4년(2021~2025년) 동안 어떻게 작동했는지에 대해 다음과 같이 알려줍니다.

1. 설정: 방범대가 작동하는 방식

이 시스템에서는 6개월 동안 모범적인 시민으로 활동한 사람이라면 누구나 "기여자(Contributor)"가 될 수 있습니다.

  • 업무: 만약 오해의 소지가 있는 게시물을 발견하면, 당신은 맥락이나 사실을 추가하기 위해 "노트(Note)"를 작성할 수 있습니다.
  • 투표: 다른 기여자들은 당신의 노트를 읽고 그것이 "도움이 됨(Helpful)", "어느 정도 도움이 됨(Somewhat Helpful)", 또는 "도움이 되지 않음(Not Helpful)"인지 투표합니다.
  • 규칙: 서로 다른 정치적 성향을 가진 사람들이 그 노트가 도움이 된다고 동의해야만 노트가 대중에게 공개됩니다. 이것은 마치 다리를 놓는 것과 같습니다. 강 양쪽의 한쪽 편 사람들만이 다리가 안전하다고 동의한다면, 그 다리는 건설되지 않습니다. 목표는 모두가 동의할 수 있는 진실을 찾는 것입니다.

2. 누가 일을 하고 있는가? (The "Super-Contributors")

연구 결과, 이 업무는 균등하게 분담되지 않았습니다. 이는 마치 소수의 헌신적인 자원봉사자들이 거의 모든 청소와 쓰레기 수거를 도맡아 하는 동네와 같습니다.

  • 핵심 인력: 아주 적은 수의 사람들이 대다수의 노트를 작성합니다. 한 사람(봇으로 추정되는)은 주로 암호화폐 사기에 관한 노트를 33,000개 이상 작성했습니다.
  • 평가 격차: 마찬가지로, 소수의 사람들이 거의 모든 투표를 수행합니다.
  • 결과: 너무나 적은 수의 사람들이 핵심적인 일을 하기 때문에, 노트가 필요한 많은 게시물이 노트를 받지 못하거나, 노트를 받더라도 충분한 투표를 얻지 못해 공개되지 못합니다.

3. 무엇에 대해 이야기하는가? (주제)

"광장"은 시끄럽지만, 자원봉사자들은 특정 유형의 소음에 집중합니다.

  • 정치가 왕이다: 가장 큰 비중(약 30~45%)은 정치와 정부에 관한 것입니다.
  • 건강: 초기에는 백신과 팬데믹에 관한 노트가 크게 몰렸습니다.
  • 전쟁과 암호화폐: 시간이 흐르면서 전쟁(우크라이나 및 가자지구)과 암호화폐 사기에 관한 노트가 더 많이 나타났습니다.
  • "NNN" 현상: 때때로 자원봉사자들은 "노트가 필요 없음(Note Not Needed, NNN)"이라는 노트를 작성합니다. 이것은 마치 이웃이 "이 이야기는 사실 거짓이 아니니, 굳이 팩트 체크를 하려 하지 마세요!"라고 말하는 것과 같습니다. 논문은 이것이 단순히 무엇이 틀렸는지를 넘어, 무엇을 수정해야 하는지에 대해 논쟁하는 방식으로 변했다고 언급합니다.

4. 언어 장벽

시스템은 글로벌하지만, "동네"들은 대부분 분리되어 있습니다.

  • 한 가지 언어, 하나의 그룹: 대부분의 사람들은 한 가지 언어로만 글을 씁니다. 설령 누군가 5개 국어를 할 수 있더라도, 노트를 작성할 때는 보통 하나의 언어에만 집중합니다.
  • 영어의 지배력: 영어는 이 광장의 주요 언어입니다. 연구자들은 대부분의 활동이 일어나는 영어 노트를 중심으로 심층 분석을 진행했습니다.

5. 속도의 문제: "너무 적고, 너무 늦다"는 이슈

이것이 가장 중요한 발견입니다. 시스템은 느립니다.

  • 대기 시간: 노트가 작성되어 대중에게 보여지기까지 평균 26시간이 걸립니다.
  • 놓친 기회: "도움이 됨" 판정을 받은 노트가 마침내 공개될 때쯤이면, 거짓 정보는 이미 전 세계로 퍼져나간 뒤입니다. 논문은 노트가 발행될 때쯤이면 해당 게시물이 이미 관중의 80%에게 도달해 있다고 지적합니다.
  • 성공률: 노트 작성이 제안된 게시물 100개 중 약 13개만이 실제로 "도움이 됨" 판정을 받아 대중에게 공개됩니다. 대부분의 노트는 대기실에 갇혀서, 공개되기 위한 충분하고 다양한 투표를 얻지 못합니다.

6. 사실 근거를 어디에서 가져오는가?

노트를 작성할 때, 기여자들은 증거를 가져오도록 권장됩니다.

  • 출처: 대부분의 노트는 출처 링크를 포함합니다.
  • 선호 출처: 가장 인기 있는 출처는 위키피디아, 유튜브, 그리고 X 자체입니다.
  • 편향성 체크: 연구자들은 사용된 웹사이트의 정치적 편향성을 확인했습니다. 놀랍게도 대부분의 상위 출처는 "중립적"인 것으로 간주되지만, 약간의 좌편향이 존재합니다. 그러나 연구자들은 한 사용자가 암호화폐 사기에 관한 특정 안티바이러스 사이트를 계속 링크하는 의심스러운 사례를 발견했으며, 이는 일부 "자원봉사자"가 특정 의도를 가진 자동화된 봇일 수 있음을 시사합니다.

결 요약

커뮤니티 노트는 군중이 스스로를 규제하도록 하는 용기 있는 실험입니다. 이 시스템은 맥락과 사실에 대한 방대한 라이브러리를 성공적으로 구축했습니다. 그러나 논문은 이 시스템이 **병목 현상(bottlenecked)**을 겪고 있다고 결론짓습니다.

  • 소수의 슈퍼 자원봉사자들에게 너무 많이 의존합니다.
  • 거짓이 퍼지는 것을 막기에는 너무 느립니다.
  • 뉴스 사이클이 지나가기 전에 얼마나 많은 다양한 사람들이 노트에 동의하게 만들 것인가에 어려움을 겪고 있습니다.

저자들은 다른 연구자들이 이 시스템을 더 빠르고 공정하게 만드는 방법을 연구할 수 있도록 모든 데이터와 코드(마치 이웃 방범대의 설계도를 넘겨주는 것처럼)를 공개했습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →