← 최신 논문
💬 NLP

Comparing British and American Audio Description of Movies

본 논문은 영국과 미국의 오디오 설명 간의 어휘, 문법, 주관성 및 지역별 가이드라인 준수에서의 차이에 관한 가설을 입증하기 위해 206편의 영화를 포함하는 코퍼스에 대한 정량적 분석을 제시하며, 이를 통해 언어적 및 구조적 차이가 유의미함을 증명한다.

원저자: Igor Sterner, Alex Lascarides, Frank Keller

게시일 2026-08-11
📖 5 분 읽기🧠 심층 분석

원저자: Igor Sterner, Alex Lascarides, Frank Keller

원본 논문은 CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기

당신은 영화를 보고 있지만, 화면을 볼 수 없다고 상상해 보세요. 배우들의 대사와 고조되는 음악 소리는 들리지만, 시각적인 이야기는 놓치고 있습니다. 캐릭터의 눈이 두려움으로 흔들리는 모습, 노을의 색깔, 혹은 누군가 등 뒤에 비밀 무기를 숨기고 있다는 사실 같은 것들 말이죠. 이를 해결하기 위해 특별한 내레이터가 등장하여 화면에서 일어나는 일을 설명해 줍니다. 이것을 **오디오 설명(Audio Description, AD)**이라고 부릅니다. 이것은 당신의 눈을 위한 '말하는 투어 가이드'라고 생각하면 됩니다. 배우들의 대사 사이의 조용한 순간마다 당신의 귀에 시각적 세부 사항을 속삭여 주는 것이죠.

하지만 까다로운 점이 하나 있습니다. 내레이터는 자신이 하고 싶은 말을 마음대로 할 수 없습니다. 그들은 마치 퍼즐 조각처럼, 흐름을 깨뜨리지 않으면서 대사의 아주 작은 틈새에 완벽하게 들어맞도록 단어를 배치해야 합니다. 또한, 사람들이 나라마다 "lift" 대신 "elevator"라고 하거나 "biscuit" 대신 "cookie"라고 말하는 것처럼, 영화를 설명하는 규칙도 지역에 따라 달라집니다. 미국과 영국에는 내레이터가 자신의 직무를 수행할 수 있도록 안내하는 서로 다른 규칙(가이드라인)이 있습니다. 어떤 규칙은 "사실만을 말하라!"고 하는 반면, 어떤 규칙은 "이야기에 도움이 된다면 캐릭터의 감정을 추측해도 좋다"라고 말합니다.

이 논문은 단순하지만 거대한 질문을 던집니다. 이 서로 다른 규칙들이 실제로 이야기 방식에 변화를 주는가? 연구자들은 미국과 영국의 오디오 설명 버전이 모두 존재하는 206편의 방대한 영화 컬렉션을 통해, 두 내레이터가 동일한 시각적 이야기를 서로 다른 방식으로 전달하고 있는지, 아니면 동일한 대본을 따르고 있는지를 알고 싶었습니다. 그들은 단순히 추측하는 데 그치지 않고, 컴퓨터를 사용하여 단어를 세고, 문법을 확인하고, 타이밍을 측정함으로써, 스토리텔링이라는 예술을 과학 실험으로 바꾸어 두 스타일이 정확히 어떻게 다른지 확인했습니다.

위대한 내레이터의 대결

연구자들은 206편의 영화를 하나의 거대한 실험실처럼 다루었습니다. 그들은 미국과 영국의 오디오 설명을 나란히 놓고 비교하며, 내레이터들이 말하는 방식에서 나타나는 구체적인 차이점을 찾아냈습니다. 이는 마치 두 명의 요리사가 똑같은 음식을 만들되 서로 다른 향신료 배합과 요리 기법을 사용하여, 그 결과물을 맛보며 무엇이 변했는지 확인하는 것과 같습니다.

1. 어휘 게임
먼저, 그들은 단어를 살펴보았습니다. 예상대로 미국 내레이터들은 더 많은 미국식 단어를 사용했고, 영국 내레이터들은 더 많은 영국식 단어를 사용했습니다. 전체적인 양에서 큰 차이는 아니었지만 분명했습니다. 예를 들어, 미국인들은 "flashlight"와 "sidewalk"라고 말한 반면, 영국인들은 "torch"와 "pavement"라고 했습니다. 미국인들은 자동차 유리를 "windshield"라고 불렀고, 영국인들은 "windscreen"이라고 불렀습니다. 연구 결과, 미국 내레이터들은 1,000문장당 약 16.8개의 미국 특유 용어를 사용한 반면, 영국 내레이터들은 4.6개만을 사용했습니다. 그 반대도 마찬가지였습니다. 영국 버전에서는 1,000문장당 15.8개의 영국식 용어가 사용된 반면, 미국 버전에서는 4.6개였습니다. 이는 작은 차이일 뿐이지만, 내레이터들이 확실히 현지 관객에게 맞춰 말하고 있음을 증명합니다.

2. 문법의 춤: "Is Doing" vs. "Does"
다음으로, 그들은 문법, 특히 내레이터가 동작을 묘사하는 방식을 확인했습니다. 영어에서는 "He walks"(단순형)라고 할 수도 있고, "He is walking"(진행형)이라고 할 수도 있습니다. 영국 내레이터들은 "is walking" 스타일을 훨씬 더 자주 사용했습니다. 실제로 영국 설명의 3.0%가 이 진행형을 사용한 반면, 미국 설명에서는 0.3%라는 아주 적은 비율을 보였습니다. 연구자들은 또한 동작이 주체에게 일어나는 "수동태"(예: "The ball was thrown")와 주체가 동작을 하는 방식(예: "He threw the ball")을 살펴보았습니다. 영국 내레이터들은 미국인들보다 수동태를 3배 이상 더 많이 사용했습니다(4.6% 대 1.3%). 미국의 가이드라인은 더 단순하고 직접적인 언어를 권장하는 듯 보이며, 영국의 가이드라인은 조금 더 다양한 문법적 변주를 허용하는 듯합니다.

3. 감정 추측하기
가장 흥미로운 차이 중 하나는 주관성에 관한 것이었습니다. 내레이터가 "아름다운" 또는 "불안해 보이는"이라고 말할 수 있을까요, 아니면 반드시 "검은 머리의 여성" 또는 "미간을 찌푸린 남성"이라고만 말해야 할까요? 영국 내레이터들은 더 창의적인 허용치를 가졌습니다. 그들은 주관적인 단어(예: "beautiful"이나 "nervous")를 더 자주 사용했는데, 평균 주관성 점수는 16.2%로 미국(13.3%)보다 높았습니다. 예를 들어, 캐릭터가 여성을 볼 때, 영국 내레이터는 "그는 아름다운 여성을 본다"라고 할 수 있지만, 미국 내레이터는 "그는 검은 머리의 젊은 여성을 본다"라는 식의 표현에 머물 수 있습니다. 미국의 규칙은 의견을 피하는 것에 대해 더 엄격하지만, 영국의 규칙은 혼란을 해소하는 데 도움이 된다면 약간의 해석을 허용합니다.

4. 이름 짓기 게임
누가 먼저 이름을 얻게 될까요? 영화에서는 때때로 캐릭터가 대사에서 이름이 불리기 훨씬 전부터 화면에 등장합니다. 영국 내레이터들은 관객이 이름을 듣기도 전에 캐릭터의 이름을 먼저 알려주는 경우가 훨씬 많았습니다. 영국 버전에서는 캐릭터의 이름을 미리 알려주는 경우가 31.4%였던 반면, 미국 내레이터들은 이 비율이 9.0%에 불과했습니다. 이름을 미리 알려줄 때, 영국 내레이터들은 영화에서 이름이 언급되기 평균 11분 전에 이름을 불렀고, 미국인들은 약 7분 전에 불렀습니다. 미국의 규칙은 일반적으로 "영화가 이름을 알려줄 때까지 기다려라"라고 하지만, 영국의 규칙은 "도움이 된다면 미리 알려줘도 괜찮다"라고 합니다.

5. 음악 위로 말하기
마지막으로, 연구자들은 내레이터가 배우의 목소리나 음악 위로 얼마나 자주 말을 겹쳐서 하는지 확인했습니다. 이것은 마치 노래가 나오는 동안 말을 하려는 DJ와 같습니다. 너무 많이 말하면 음악을 놓칠 수 있습니다. 미국 내레이터들은 영화의 대사 및 음악과 겹쳐서 말하는 데 더 적극적이었으며, 약 14.1%의 시간 동안 겹쳤습니다. 영국 내레이터들은 훨씬 더 엄격하여 8.5%만 겹쳤습니다. 이는 대사 위로 절대 말해서는 안 된다는 영국의 규칙과 일치하며, 미국의 규칙은 이보다 조금 더 완화되어 있습니다.

결론

이 연구는 단순히 작은 무작위적 차이를 발견한 것이 아니라, 206편의 모든 영화에서 일관된 패턴을 찾아냈습니다. 연구자들이 규칙에 근거하여 세운 모든 가설이 데이터에 의해 뒷받침되었습니다. 미국 스타일은 일반적으로 더 직접적이고, 더 단순한 문법을 사용하며, 감정을 추측하는 것을 피하고, 캐릭터의 이름을 기다렸다가 말하며, 영화의 소리와 겹치는 것을 허용합니다. 영국 스타일은 조금 더 유연하여, 더 다양한 문법을 사용하고, 감정 묘사를 허용하며, 캐릭터의 이름을 더 일찍 알려주고, 대사와 겹치지 않도록 매우 주의합니다.

연구자들은 또한 컴퓨터가 오디오 설명만을 읽고 장면 전환(예: 낮 장면에서 밤 장면으로 바뀌는 것)을 포착하도록 가르치려 노력했습니다. 컴퓨터는 영국 설명보다 미국 설명에서 이러한 장면 전환을 훨씬 더 잘 포착했습니다. 이는 미국 내레이터들이 새로운 장면이 시작되었음을 알리기 위해 더 명확한 "표지판"(예: "이제, 우리는 텐트 안에 있다")을 사용하는 반면, 영국 내레이터들은 조금 더 미묘하게 처리할 수 있음을 시사합니다.

결국, 이 논문은 오디오 설명이 단 하나의 정답(one size fits all)만 있는 것이 아님을 보여줍니다. 비록 목표는 동일하게—시각 장애인이 영화를 즐길 수 있도록 돕는 것—하더라도, 그 목표를 달성하는 방식은 지역에 따라 달라집니다. 이는 우리가 단지 눈에 보이는 것을 설명하고 있을 때조차도, 스토리텔링이 우리가 따르는 규칙과 우리가 사는 문화에 의해 형성된다는 점을 상기시켜 줍니다.

연구 분야의 논문에 파묻히고 계신가요?

연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.

Digest 사용해 보기 →