← 最新の論文
📄 social_science

Computational Criticism of Classical-Chinese Residues in Lu Xun (1903–1936): A Six-Function Taxonomy, Sublanguage Detection, and the Register × Stratum Two-Dimensional Model

本研究は、魯迅の全集に対して計算批評学を適用することで、六機能の分類体系とレジスター・層モデルを提示し、公的な著作においては表層的な古典語の使用が衰退した一方で、古典的思考の安定した「亜言語」がすべてのレジスターにわたって存続していたことを明らかにし、それによって一様な言語的後退という概念に異を唱え、五四運動における言語改革における選択的な「公から私への」移行を支持するものである。

原著者: Jun Zeng

公開日 2026-08-11
📖 1 分で読めます☕ さくっと読める

原著者: Jun Zeng

原論文は CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む

機械の中の幽霊:なぜ魯迅の言葉は決して単なる「新しいもの」ではなかったのか

ある人物を理解しようとして、その人の話を聞いている場面を想像してみてください。もしその人が、家ではある言語を話し、学校や仕事では別の現代的な言語に切り替えて生活しているとしたら、状況ごとに全く異なる話し方をするだろうと予想するかもしれません。しかし、もしそうでなかったらどうでしょう? もし、新しい言葉を使いながらも、心の奥底では依然として古いやり方で思考を組み立てていたとしたら? これこそが「計算機批評(computational criticism)」が解明しようとしている謎です。これは、コンピューター科学者と文学の探偵がタッグを組む分野です。単に本を読んで「これは古臭い感じがする」と言うのではなく、ソフトウェアを使用して、数千ページにわたるあらゆる単語、文章構造、句読点をカウントします。彼らは文学を巨大なデータセットとして扱い、人間の目では見落としてしまうような隠れたパターンを探り当てるのです。

ここでの大きな問いは、過去の「幽霊」についてです。何世紀もの間、中国の作家たちは「文言(wenyan)」と呼ばれる、形式的で古風な書き方を用いてきました。1900年代初頭、「新文化運動」という大規模な運動が、この古い様式を葬り去り、人々の話し言葉に近い「白話(baihua/現代口語)」へと置き換えようとしました。この運動のリーダーの一人が、魯迅という作家でした。彼は新しい、現代的なスタイルで書くことで有名です。しかし、誰もが、魯迅は依然として古いスタイルに憑りつかれているのではないかと疑っていました。大きな論争はこうでした。「彼は本当に古い言語を捨て去ったのか、それとも単に隠れているだけなのか?」 本論文は、膨大なコンピューター分析を用いることで、推測ではなく、その「幽霊」がどのように動いたかを正確に測定することによって、この問いに最終的な答えを出そうとしています。


探偵の仕事:魯迅の「古い幽霊」を数える

魯迅(1881–1936)は、現代中国文学のスーパースターです。彼は現代中国小説の発明を助けた人物です。彼はかつて、古典的な言語は背中に乗った「古の幽霊」のようなものであり、振り払うことができないと述べました。長い間、学者たちはその幽霊が何をしているのかについて議論してきました。それらは単なる偶然の癖だったのでしょうか? それとも、魯迅は密かに意図的にそれらを使っていたのでしょうか?

ジュン・ゼン(Jun Zeng)によるこの論文は、推測をやめ、カウントを開始することに決めました。彼らは、魯迅の生涯の全著作、約437万文字におよぶ膨大なデジタル・ライブラリーを構築しました。これは単に発表された小説やエッセイだけでなく、これまでこの規模で共に研究されたことのない、彼の私的な手紙や日記も含まれています。彼らはコンピューターを使用してこのテキストの山をスキャンし、魯迅が古い言語を使用していた6つの異なる方法を探りました。

これは、特定の古代のスパイスを使って料理を育ってきたシェフを想像してみてください。コンピューターはこう問いかけます。「シェフはメインディッシュ(公的な執筆)にまだそのスパイスを使っているのか? 秘密の家族のレシピ(私的な執筆)のために取っておいているのか? それとも、現代的な材料が足りなくなった時に、ほんの少し振りかけているだけなのか?」

大きな驚き:幽霊は去ったのではなく、引っ越しをした

最も衝撃的な発見は、古い言語が単に消え去ったのではないということです。それは一様に後退したわけではありませんでした。代わりに、それは奇妙なダンスを踊りました。

魯迅が公衆に向けて書いたとき(有名なエッセイ、物語、翻訳)、古い言語の量は急激に減少しました。キャリアの初期の約0.0994から、後半の0.0655へと下がりました。まるで、彼が新しい言語への切り替えに成功しているかのように見えました。

しかし、ここにひねりがあります。 研究者が彼の私的な手紙や日記を見たとき、物語は全く異なるものになりました。私的なノートにおいて、古い言語は減少するどころか、むしろ増加していたのです。初期の0.0383から、後半には0.0695へと上昇していました。実際、晩年の彼の私的な執筆は、公的な執筆よりもさらに古い言語に満ちていました。

これは、魯迅が古典的な訓練を失ったのではなく、単にそれを「移動」させたことを証明しています。彼は、誰にも見られない私的な部屋に「幽霊」を留め置き、一方で世界に対しては、よりクリーンで現代的な顔を見せていたのです。論文ではこれを「レジスター・シフト・メカニズム(register-shift mechanism)」と呼んでいます。それは後退ではなく、移住でした。

深層の「サブランゲージ」:決して変わることのない脳

さらに興味深いのは、コンピューターが「内部」で何を発見したかです。研究者たちは、**サブランゲージ(下位言語)**を見つけるための特別な検出器を構築しました。これは古い言葉を使うことについての話ではありません。古い「思考パターン」を使うことについての話です。

あなたが英語を話しているけれど、ラテン語を話しているかのように文章を組み立てていると想像してください。あなたは現代的な言葉を使っているかもしれませんが、あなたの脳は依然として古い方法で論理を構築しています。コンピューターはこの「サブランガージュ指数」を測定しましたが、それは驚くほど安定していることがわかりました。それは、魯迅のキャリアの始まりから終わりまで、ほぼ正確に同じ(約0.67)であり続けました。

彼が公的なエッセイを書こうが、私的な手紙を書こうが、あるいは学術書を書こうが、彼の脳はこれらの深い、古代のパターンを使い続けていました。論文は、「古い幽霊」は単に背中に乗っていただけでなく、彼の脳の中にあったことを示唆しています。彼が現代的な言葉に切り替えたとしても、思考を繋ぎ合わせる方法は、深く古典的な伝統に根ざしたままでした。

「ストップギャップ(継ぎ当て)」の謎:行き詰まった時に彼が古い言葉を使った理由

論文はまた、なぜ魯迅が古い言語を使用したのかについても調査しました。彼らは主に2つの理由を見出しました。

  1. 表現的(Expressive):物語を伝えたり、論点を主張したりするために使う(これは時間の経過とともに71.1%減少しました)。
  2. ストップギャップ(Stopgap):現代的な言葉が見つからない時に使う。

ここで面白い発見があります。もしあなたが私的な日記を書いているなら、どんな言葉でも自由に使えるので、古い「ストップギャップ」としての言葉を最も多く使うだろうと考えるかもしれません。しかし、コンピューターは正反対の結果を示しました。魯迅は、古い「ストップギャップ」の言葉を、公的なエッセイで最も多く使い(1万文字あたり360.68回)、日記では最も少なく使いました(129.23回)。

なぜでしょうか? なぜなら、彼の公的なエッセイの方が難しかったからです。それらは複雑で、議論的で、大きな思想に満ちていました。難しい概念を現代の言葉で説明しようとして行き詰まったとき、彼はバックアップ・ツールとして古い古典的な言葉に手を伸ばしたのです。日記は単なる独り言なので、バックアップは必要ありませんでした。論文は、彼が自由だったから古い言葉を使ったのではなく、彼が複雑な思考を必要とし、助けを求めていたからこそ、それらを使ったのだと主張しています。

「ヨーロッパ」の神話:古と新は親友ではなかった

魯迅が、古い中国の思考を現代の言葉へと翻訳するのを助けるために、ヨーロッパ式の文章(「そして」や「なぜなら」といった言葉を多用した、長く複雑な文章)を用いたという通説がありました。ヨーロッパの文法が、古と新の間の架け橋になるという考えです。

コンピューターはこの仮説を検証しましたが、それは間違いでした。データは、「ヨーロッパ的」なスタイルと「古い中国語」のスタイルの間に何の関連性もないことを示しました。実際、それらは独立しているように見えました。論文は「テンション・モデル(緊張モデル)」という新しい概念を提案しています。一方が他方を助けるのではなく、魯迅は長くうねるヨーロッパ的な文章と、短くパンチの効いた古典的なフレーズを同時に使用し、独特で緊張感のある力強いスタイルを作り上げていたのです。それらは協力し合っていたのではなく、戦い合っており、その戦いが彼の文章を強力なものにしていたのです。

最終的な結論:二次元のマップ

では、最終的な全体像はどうなるのでしょうか? 論文は、レジスター(公的 vs 私的)とストラタム(表層の言葉 vs 深層の思考)という二次元のマップを用いて、魯迅の執筆を捉える新しい方法を提案しています。

  • 表層レベル: 公的な場では、古い言葉は消えていった。私的な場では、それらは強く残った。
  • 深層レベル: 古い思考パターンは、どこにおいても強く残っていた。

論文は、「現代言語の勝利」とは、新しいものが古いものに取って代わるという単純な物語ではなかったと結論付けています。それは、選択的な移住でした。魯迅は自らの過去を捨て去ったのではなく、それを区分けしたのです。彼は、現代的な仮面を被りながらも、私生活と深い脳の中に「幽霊」を留めておいたのです。

この研究は、単に魯迅について教えてくれるだけではありません。コンピューターがいかに文学の隠れた層を見通す助けとなるかを示しています。最も重要なことは、時に、あなたが発する言葉そのものではなく、どのように考えるかという目に見えないパターンにあるのだということを、この研究は証明しています。そして、魯迅の場合、それらのパターンは、彼が振り払おうとした幽霊と同じくらい古く、同時に、彼が作り上げた現代の世界と同じくらい鮮烈なものだったのです。

自分の分野の論文に埋もれていませんか?

研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。

Digest を試す →