Computational Criticism of Classical-Chinese Residues in Lu Xun (1903–1936): A Six-Function Taxonomy, Sublanguage Detection, and the Register × Stratum Two-Dimensional Model
본 연구는 루쉰의 전집에 대한 계산 비평을 채택하여 6기능 분류법과 레지스터-층위 모델을 제안하며, 공적 저술에서 표면적인 고어 사용은 감소했으나 고전적 사고의 안정적인 '하위 언어'는 모든 레지스터에 걸쳐 지속되었음을 밝힘으로써, 일률적인 언어적 퇴보라는 관점에 이의를 제기하고 5·4 운동 시기 언어 개혁의 선택적인 '공적-사적' 전환을 뒷받침한다.
원본 논문은 CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) 라이선스로 제공됩니다. 이것은 아래 논문에 대한 AI 생성 설명입니다. 저자가 작성하거나 승인한 것이 아닙니다. 기술적 정확성을 위해서는 원본 논문을 참조하세요. 전체 면책 조항 읽기
기계 속의 유령: 루쉰의 언어가 결코 단순한 "새로운 것"이 아니었던 이유
어떤 사람을 이해하기 위해 그가 말하는 것을 듣고 있다고 상상해 보십시오. 만약 그가 집에서는 한 가지 언어를 사용하며 자랐지만, 학교와 직장에서는 다른 현대적인 언어로 전환하여 말한다면, 당신은 상황에 따라 그가 완전히 다르게 들릴 것이라고 예상할 것입니다. 하지만 만약 그렇지 않다면 어떨까요? 만약 그의 뇌가 새로운 단어들을 사용하면서도, 마음 깊은 곳에서는 여전히 예전 방식으로 생각을 배열하고 있다면 어떨까요? 이것이 바로 "컴퓨터 비평(computational criticism)"이 해결하고자 하는 종류의 미스터리입니다. 이 분야는 컴퓨터 과학자와 문학 탐정이 팀을 이루는 곳입니다. 단순히 책을 읽고 "이것은 구식처럼 느껴진다"라고 말하는 대신, 그들은 소프트웨어를 사용하여 수천 페이지에 걸친 모든 단어, 문장 구조, 그리고 구두점을 계산합니다. 그들은 문학을 하나의 거대한 데이터셋으로 취급하며, 인간의 눈이 놓칠 수 있는 숨겨진 패턴을 찾아냅니다.
여기서 핵심 질문은 과거의 "유령들"에 관한 것입니다. 수 세기 동안 중국 작가들은 원옌(wenyan, 고전 한문)이라 불리는 격식 있고 고풍스러운 문체를 사용했습니다. 1900년대 초, 신문화 운동이라는 거대한 움직임이 그 오래된 양식을 없애고 사람들이 실제로 말하는 방식과 유사한 바이화(baihua, 백화문/현대 구어체)로 대체하려고 시도했습니다. 이 운동의 지도자는 루쉰(Lu Xun)이라는 작가였으며, 그는 새로운 현대적 문체로 글을 쓴 것으로 유명합니다. 하지만 모든 이들은 루쉰이 여전히 옛 스타일의 영향을 받고 있다고 의심했습니다. 큰 논쟁은 이것이었습니다: 그는 진정으로 옛 언어를 버린 것인가, 아니면 단지 숨겨져 있었던 것인가? 이 논문은 정확히 어떻게 그 "유령들"이 움직였는지를 측정함으로써, 추측이 아닌 정밀한 계산을 통해 그 질문에 최종적인 답을 내놓습니다.
탐정 작업: 루쉰의 "옛 유령들" 세기
루쉰(1881–1936)은 현대 중국 문학의 슈퍼스타입니다. 그는 현대 중국 소설을 만드는 데 도움을 준 인물입니다. 그는 고전 언어가 자신의 등에 붙어 떨어지지 않는 "고대의 유령"과 같다고 유명하게 말했습니다. 오랫동안 학자들은 그 유령들이 무엇을 하고 있는지에 대해 논쟁해 왔습니다. 그것들은 그저 우연한 습관이었을까요? 아니면 루쉰이 비밀리에 의도적으로 사용하고 있었던 것일까요?
준 쪵(Jun Zeng)이 작성한 이 논문은 추측을 멈추고 숫자를 세기로 결정했습니다. 그들은 루쉰의 생애 전체 작업물인 약 437만 자의 방대한 디지털 라이브러리를 구축했습니다. 이것은 단지 출판된 소설과 에세이뿐만이 아니었습니다. 이전에 이 정도 규모로 함께 연구된 적이 없는 그의 개인적인 편지와 일기까지 포함되었습니다. 그들은 이 텍스트의 산을 스캔하여 루в쉰이 옛 언어를 사용하는 여섯 가지 서로 다른 방식을 찾기 위해 컴퓨터를 사용했습니다.
이것을 특정 고대 향신질을 사용하며 요리하며 자란 요리사에 비유해 보십시오. 컴퓨터는 물었습니다: 요리사가 메인 요리(공적인 글쓰기)에도 그 향신질을 여전히 사용하고 있는가? 그는 비밀스러운 가족 레시피(사적인 글쓰기)를 위해 그것을 아껴두고 있는가? 아니면 현대적인 재료가 떨어졌을 때 한 꼬집씩 뿌려 넣고 있는 것뿐인가?
거대한 반전: 유령들은 떠나지 않았다; 그들은 집을 옮겼다
가장 충격적인 발견은 옛 언어가 단순히 사라진 것이 아니라는 점입니다. 그것은 균일하게 퇴보하지 않았습니다. 대신, 그것은 이상한 춤을 추었습니다.
루쉰이 대중을 위해 글을 쓸 때—그의 유명한 에세이, 이야기, 그리고 번역물들—옛 방식의 언어의 양은 급격히 떨어졌습니다. 초기 경력의 약 0.0994에서 후기에는 0.0655로 내려갔습니다. 그것은 마치 그가 성공적으로 새로운 언어로 전환한 것처럼 보였습니다.
하지만 여기에 반전이 있습니다: 연구자들이 그의 사적인 편지와 일기를 살펴보았을 때, 이야기는 완전히 달랐습니다. 그의 사적인 글에서는 옛 언어가 줄어들지 않았습니다. 오히려 증가했습니다. 초기 0.0383에서 나중에는 0.0695로 증가했습니다. 사실, 그의 말년의 사적인 글쓰기는 그의 공적인 글쓰기보다 옛 언어가 더 많이 담겨 있었습니다.
이것은 루쉰이 고전 교육을 잃어버린 것이 아님을 증명합니다. 그는 단지 그것을 옮겼을 뿐입니다. 그는 아무도 볼 수 없는 자신의 사적인 방에 "유령들"을 간직한 채, 세상에는 더 깨끗하고 현대적인 얼굴을 보여주었습니다. 논문은 이를 "레지스터-시프트 메커니즘(register-shift mechanism, 문체 전환 기제)"이라고 부릅니다. 그것은 후퇴가 아니라 이주였습니다.
심층적인 "하위 언어": 변하지 않은 뇌
더 흥anche한 것은 컴퓨터가 "본네트 아래"에서 무엇을 찾아냈는가 하는 점입니다. 연구자들은 **하위 언어(sublanguage)**를 찾기 위한 특별한 탐지기를 만들었습니다. 이것은 옛 단어를 사용하는 것에 관한 것이 아닙니다. 그것은 옛 사고 패턴을 사용하는 것에 관한 것입니다.
당신이 영어를 말하고 있지만, 라틴어를 말하는 것처럼 문장을 배열하고 있다고 상상해 보십시오. 당신은 현대적인 단어를 사용할 수 있지만, 당신의 뇌는 여전히 옛날 방식으로 논리를 구축하고 있습니다. 컴퓨터는 이 "하위 언어 지수"를 측정했고, 그것이 놀라울 정도로 안정적이라는 것을 발견했습니다. 그것은 루쉰의 경력 시작부터 끝까지 거의 동일하게 유지되었습니다(약 0.67).
그가 공적인 에세이를 쓰든, 사적인 편지를 쓰든, 혹은 학술적인 책을 쓰든, 그의 뇌는 이 깊고 오래된 패턴을 계속 사용했습니다. 논문은 "옛 유령들"이 단지 그의 등에 있는 것이 아니라, 그의 뇌 안에 있었다고 제안합니다. 그가 현대적인 단어로 전환했을 때조차, 생각을 연결하는 방식은 깊이 고전적 전통에 뿌리를 두고 있었습니다.
"임시 방편(Stopgap)"의 미스터리: 왜 그는 막혔을 때 옛 단어를 사용했는가
논문은 또한 루쉰이 왜 옛 언어를 사용했는지 조사했습니다. 그들은 두 가지 주요 이유를 발견했습니다:
- 표현적(Expressive): 이야기를 전달하거나 논점을 주장하기 위해 사용하는 것 (시간이 흐름에 따라 71.1% 감소함).
- 임시 방편(Stopgap): 현대적인 단어를 찾지 못할 때 사용하는 것.
여기 재미있는 발견이 있습니다: 당신은 만약 사적인 일기를 쓴다면 원하는 단어를 자유롭게 사용할 수 있으므로, 옛 "임시 방편" 단어를 가장 많이 사용할 것이라고 생각할 수도 있습니다. 하지만 컴퓨터는 정반대의 결과를 찾아냈습니다. 루쉰은 공적인 에세이에서 "임시 방편"의 옛 단어를 가장 많이 사용했습니다(10,000자당 360.68회). 반면 일기에서는 가장 적게 사용했습니다(129.23회).
왜일까요? 그의 공적인 에세이는 가장 어려운 작업이었기 때문입니다. 그것들은 복잡하고, 논쟁적이며, 거대한 아이디어들로 가득 차 있었습니다. 현대 언어로 어려운 개념을 설명하려다 막혔을 때, 그는 옛 고전 단어를 "백업 도구"로서 붙잡았습니다. 그의 일기는 그저 자신에게 말하는 것이었기에 백업이 필요하지 않았습니다. 논문은 그가 자유롭게 사용하기 위해 옛 단어를 사용한 것이 아니라, 그가 복잡한 내용을 다루고 있었기에 도움이 필요했기 때문에 사용했다고 주장합니다.
"유럽식" 신화: 옛것과 새것은 친한 친구가 아니었다
루쉰이 (길고 복잡하며 '그리고', '때문에'와 같은 단어가 많은) 유럽 스타일의 문장을 사용하여 자신의 옛 중국식 생각을 현대 언어로 번역하는 데 도움을 받았다는 인기 있는 이론이 있었습니다. 유럽의 문법이 구시대와 신시대 사이의 가교 역할을 한다는 아이디어였습니다.
컴퓨터는 이를 테스트했고, 그것은 틀렸습니다. 데이터는 "유럽적" 스타일과 "옛 중국적" 스타일 사이에 아무런 연관성이 없음을 보여주었습니다. 사실, 그들은 독립적인 것처럼 보였습니다. 논문은 "텐션 모델(tension model, 긴장 모델)"이라는 새로운 아이디어를 제안합니다. 하나가 다른 하나를 돕는 대신, 루쉰은 길고 구불구불한 유럽식 문장과 짧고 강렬한 고전적 구절을 동시에 사용하여 독특하고 긴장감 넘치며 강력한 스타일을 만들어냈습니다. 그것들은 서로 협력하는 것이 아니라 싸우고 있었으며, 그 싸움이 그의 글을 강력하게 만들었습니다.
최종 판결: 2차원 지도
그렇다면 최종적인 그림은 무엇입니까? 논문은 레지스터(Register, 공적 vs 사적)와 층위(Stratum, 표면 단어 vs 깊은 사고)라는 두 가지 차원의 지도를 사용하여 루쉰의 글을 바라보는 새로운 방법을 제안합니다.
- 표면 수준: 공적인 자리에서 옛 단어는 사라졌습니다. 사적인 자리에서 그것은 강하게 유지되었습니다.
- 깊은 수준: 옛 사고 패턴은 어디에서나 강하게 유지되었습니다.
논문은 현대 언어의 승리가 새로운 것이 옛것을 대체하는 단순한 이야기가 아니라고 결론짓습니다. 그것은 선택적인 이주였습니다. 루쉰은 자신의 과거를 버린 것이 아니라, 그것을 구분하여 저장했습니다. 그는 공적인 모습을 위해 현대적인 가면을 쓰는 동안, 자신의 사적인 삶과 깊은 뇌 속에 "유령들"을 간직했습니다.
이 연구는 단지 루쉰에 대해 말해주는 것이 아닙니다. 그것은 컴퓨터가 어떻게 우리가 문학의 숨겨진 층위를 볼 수 있게 도와주는지를 보여줍니다. 그것은 때때로 가장 중요한 것이 당신이 말하는 단어가 아니라, 당신이 생각하는 방식의 보이지 않는 패턴임을 증명합니다. 그리고 루쉰의 경우, 그 패턴은 그가 떨쳐내려 했던 유령들만큼이나 오래되었지만, 그가 만든 현대 세계만큼이나 생생하게 살아있었습니다.
연구 분야의 논문에 파묻히고 계신가요?
연구 키워드에 맞는 최신 논문의 일일 다이제스트를 받아보세요 — 기술 요약 포함, 당신의 언어로.