← 최신 논문
💬 NLP

Misinformation Span Detection in Videos via Audio Transcripts

이 논문은 오디오 대본을 활용하여 비디오 내 허위 정보의 발생 구간과 주장을 식별하는 '허위 정보 스팬 탐지'를 위해 두 개의 새로운 데이터셋을 구축하고, 최첨단 언어 모델을 통해 해당 작업을 수행한 연구입니다.

원저자: Breno Matos, Rennan C. Lima, Savvas Zannettou, Fabricio Benevenuto, Rodrygo L. T. Santos

게시일 2026-04-24
📖 3 분 읽기☕ 가벼운 읽기

원저자: Breno Matos, Rennan C. Lima, Savvas Zannettou, Fabricio Benevenuto, Rodrygo L. T. Santos

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

이 논문은 **"긴 영상 속에서 거짓말이 딱 어디에 있는지 찾아내는 기술"**에 대한 연구입니다.

기존에는 "이 영상 전체가 가짜 뉴스인가?"라고만 물었다면, 이 연구는 **"이 1 시간짜리 영상 중, 3 분 20 초부터 3 분 45 초까지가 거짓말이다"**라고 정확히 짚어내는 것을 목표로 합니다.

이 복잡한 내용을 일상적인 비유로 쉽게 설명해 드릴게요.


🎬 비유: "거짓말 탐정"과 "긴 영화"

상상해 보세요. 누군가 1 시간짜리 긴 다큐멘터리 영상을 올렸습니다. 이 영상은 대부분 사실이지만, 중간중간 거짓말 16 개를 섞어놓았습니다.

  • 기존 방식 (구식 탐정): "이 영상은 가짜 뉴스가 섞여 있으니 전체를 삭제하거나 경고하자!"라고 말합니다. 하지만 시청자는 "어디가 거짓말인지 모르겠는데, 그냥 다 믿고 봐도 되나?"라고 혼란스러워합니다.
  • 이 연구의 방식 (신식 탐정): "이 영상은 90% 는 사실입니다. 하지만 3 분 20 초에 "A 는 거짓말입니다", 15 분 40 초에 "B 는 사실과 다릅니다"라고 정확한 위치를 알려드립니다."

이 연구는 바로 이 **'정확한 위치 (스팬)'**를 찾아내는 기술을 개발한 것입니다.


🔍 연구가 어떻게 진행되었나요? (3 단계 과정)

연구진들은 이 '거짓말 탐정'을 만들기 위해 다음과 같은 과정을 거쳤습니다.

1. 소리를 글로 바꾸기 (자막 만들기)

영상은 길고 복잡합니다. 컴퓨터가 영상을 직접 분석하기보다, 사람이 말한 내용을 글 (대본) 로 바꾸는 것이 훨씬 빠르고 정확합니다.

  • 비유: 긴 영화를 보고 내용을 기억하는 대신, **영화 대본 (자막)**을 받아 적는 것과 같습니다. 연구진은 AI(위스퍼) 를 이용해 영상 소리를 모두 텍스트로 변환했습니다.

2. 거짓말 목록과 대본 대조하기 (수색 시작)

브라질의 유명한 팩트체크 기관 (Aos Fatos) 이 이미 "이 사람은 이런 거짓말을 했다"라고 거짓말 목록을 만들어두었습니다.

  • 비유: 경찰이 "범인은 A, B, C 세 가지 거짓말을 했다"는 수배 목록을 가지고 있습니다. 이제 대본 (자막) 을 훑어보며 "어디에 이 거짓말들이 숨어 있을까?" 찾아내는 작업입니다.

3. AI 가 거짓말 위치를 표시하기 (마지막 단추)

컴퓨터가 대본을 읽으며, 수배 목록에 있는 거짓말과 가장 비슷한 문장을 찾아냅니다.

  • 비유: AI 가 대본을 읽다가 "아! 여기 'A 거짓말'이 있네!"라고 형광펜으로 표시해 주는 것입니다. 이때 AI 는 "거짓말이 시작되는 지점"과 "끝나는 지점"을 정확히 찾아냅니다.

📊 결과: 얼마나 잘할까요?

연구진은 두 가지 새로운 데이터셋 (브라질 전 대통령의 영상 500 개 이상, 선거 관련 영상 70 개 이상) 을 만들어 AI 를 훈련시켰습니다.

  • 성공률: AI 는 영상 속 거짓말이 있는 구간을 **약 68% (F1 점수 0.68)**의 정확도로 찾아냈습니다.
  • 의미: 완벽하지는 않지만, 사람이 일일이 1 시간 영상을 다 보고 거짓말을 찾을 필요 없이, AI 가 **"여기, 여기, 여기가 의심스럽습니다"**라고 알려주면 팩트체크 전문가들이 그 부분만 집중해서 확인하면 됩니다. 시간을 100 배 이상 아낄 수 있는 셈입니다.

💡 왜 이 연구가 중요할까요?

  1. 시청자를 위한 '경고 라벨': 유튜브나 틱톡 같은 플랫폼에서 거짓말이 나올 때, 영상 전체를 막는 게 아니라 **"이 부분에서 거짓말이 나옵니다"**라고 영상 위에 경고 문구를 띄워줄 수 있습니다.
  2. 팩트체크의 속도: 전문가들이 하루 종일 영상을 보는 대신, AI 가 찾아낸 '의심 구간'만 확인하면 되므로 거짓말을 훨씬 빠르게 바로잡을 수 있습니다.
  3. 새로운 기준: 이 연구는 "거짓말이 있는지 없는지"를 넘어서, **"어디에 있는가"**를 찾는 새로운 기준을 세웠습니다.

🚀 결론

이 논문은 **"긴 영상 속에서 거짓말의 정확한 위치를 찾아내는 첫 번째 지도"**를 만든 것입니다. 아직 완벽하지는 않지만, 앞으로 AI 가 더 똑똑해지면 우리가 보는 모든 영상에서 거짓말이 튀어 나오는 순간, AI 가 자동으로 "이건 가짜입니다!"라고 손가락질해 줄 날이 올 것입니다.

연구진들은 이 데이터와 기술을 공개하여, 전 세계의 연구자들이 함께 이 '거짓말 탐정'을 더 발전시키기를 바라고 있습니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →