Darshana Graph: A Parallel Commentary Corpus for Comparative Indian Philosophy, with Stylometric and Exploratory Graph Analyses
本論文は、ヒンドゥー教、仏教、およびジャイナ教の伝統からなる125,000件以上の記録からなる独自の並行注釈コーパスであるDarshana Graphを紹介し、それが直接的な注釈者間比較を可能にすることを示し、さらに、論証スタイルの文体論的分析と、哲学的な関係性を抽出・検証するための制約付きLLMパイプラインを通じたその有用性を実証するものである。
原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む
ある巨大で古めかしい図書館を想像してみてください。そこでは、わずか数冊の基礎的な書物が、千年にわたって読み継がれ、議論の的となってきました。この図書館では、異なる学者グループ(ヒンドゥー教、仏教、ジャイナ教)が、全く同じ聖句に対して注釈を書き残しています。通常、現代のデジタルライブラリを利用する場合、一冊の本を選び、ある学者の解釈を読みます。他の学者の議論を、原文と並べて見ることは決してありません。
「Darshana Graph」は、これを変える新しいデジタルプロジェクトです。これは、巨大で整理されたスプレッドシートを構築するようなものです。あらゆる古代テキストの全聖句を「行」とし、18の異なる歴史的学者による様々な解釈を「列」として埋めていくのです。
以下に、研究者たちが何を行い、何を見出したのかを簡単に解説します。
1. 大規模なコレクション(コーパス)
研究者たちは、12万5,000件以上のテキスト記録を集めました。
- 「目の前の大きな存在」: これらの記録の大部分(約92%)は、仏教の**パーリ・カノン(パーリ仏典)**に由来します。これは、建物の巨大な土台のようなものです。
- 「特別な要素」: 真の魔法は、残りの8,500件の記録にあります。これらは、ヒンドゥー教やジャイナ教のテキストであり、同じ元の聖句が、異なる学派(アドヴァイタ、ドヴァイタ、ジャイナ教など)からの注釈と並べて配置されています。
- なぜ重要なのか: これは、全員がルールブックの全く同じ一節を引用しながらも、その意味を全く異なる方法で説明している「討論の書き起こし」を持っているようなものです。このような規模での整合性は、これまで成されたことがありません。
2. 分析1: 「執筆スタイル」の探偵作業
研究者たちは、意味を推測するために複雑なAIを使用したわけではありません。代わりに、単純な数学を用いて、学者が何を論じたかではなく、どのように論じたかを測定しました。彼らは次のような点に着目しました。
- 学者はどれくらいの頻度で元の聖典を引用したか?
- どれくらいの頻度で「私の対立者は間違っている」と言ったか?
- 文章の長さはどのくらいか?
判明したこと:
- トレードオフ: 彼らはあるパターンに気づきました。元のテキストを非常に多く引用する学者は、対立者への反論をあまりしませんでした。逆に、対立者への反論を多く行う者は、テキストの引用が少ない傾向にありました。これは、「本にこう書いてあるから私が正しい」対「あなたの考えには欠陥がある」という、二つの異なる戦略のようなものです。
- 「反駁(はんばく)」の傾向: 特定の思想体系(ドヴァイタ学派)において、興味深い傾向が見られました。創始者は他者への反論をほとんど書きませんでしたが、時が経つにつれ、同じ系統の後の学者たちは、他者への反論をはるかに多く書くようになりました。まるで、世代を経るごとに議論がより激しく、防衛的になっていったかのようです。
- 仏教テキスト: 仏教テキストの中でも、あるコレクションは短くパンチの効いたスローガンのように書かれており(『ダンマパダ』など)、他のものは長く流れるようなエッセイのように書かれていることが分かりました。
3. 分析2: AIによる「関係性マッパー」
第二の部分では、彼らは大規模言語モデル(LLM)を用いた、アイデアの相関関係をマッピングしようとする賢い図書委員のような、小さなコンピュータプログラムを使用しました。
- ルール: AIが勝手なことを言ったり(ハルシネーション)、捏造したりするのを防ぐため、「IS THE SAME AS(〜と同じである)」や「IS DIFFERENT FROM(〜と異なる)」といった、事前に承認された厳格な関係性のリストを与えました。もしAIがリストにない言葉を使おうとした場合、システムは自動的にそれを排除しました。
- 結果: 彼らは「知識グラフ」(つながったアイデアの網)を構築しました。
- 大きな発見: AIは、インド哲学における最大の歴史的な争い、すなわち**「人間の魂(アートマン)は究極の現実(ブラフマン)と同じなのか?」**という問題を正しく特定しました。
- ある学派は「はい、それらは同一である」と言いました。
- 別の学派は「いいえ、それらは全く異なるものである」と言いました。
- AIはこの不一致を完璧にマッピングし、各学派がテキストに基づいてどこで意見を異にしているのかを正確に示しました。
4. 正直な「細かい注釈」(限界事項)
著者たちは、このプロジェクトがまだ完璧ではない点についても率直に述べています。
- AIは完璧ではない: 時として、AIは混乱して、確信がない場合に汎用的なラベル(「IS A QUALIFIED ASPECT OF(〜の限定的な側面である)」)を使いすぎてしまうことがありました。
- 欠けているピース: ジャイナ教の二つの主要な分派を区別することができず、また、新しいAI手法を用いて同じ学派内の異なる学者を比較するための十分なデータもありませんでした。
- 「真実」の保証はない: 彼らは、AIの結果の一つひとつを人間がチェックするチームを雇ったわけではありません。簡単なスポットチェックは行いましたが、グラフを100%信頼できるものにするには、さらなる人間の検証が必要であると認めています。
結論
この論文は、古代の哲学的議論を初めて並べて見ることができる、巨大な新しいツール(Darshana Graph)を紹介しています。彼らは、単純な数学を用いて学者がどのように議論したかを示し、制御されたAIを用いて、異なる学派がどこで意見を異にしているかをマッピングしました。
彼らは、インド哲学のすべての謎を解明したと主張しているわけではありません。むしろ、「ここにデータがあり、ここから得られた知見があり、そしてここで行った間違いがあります。これが、他の人々がより深く掘り下げる助けになることを願っています」と言っているのです。彼らは、誰でも利用できるように、すべてのデータとコードを公開しています。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。