Generative Artificial Intelligence and Linguistic Epistemic Justice for isiZulu and African Languages in Multilingual Education
本稿は、イシズール語やその他のアフリカ諸語における言語的・認識論的正義をAIを介した教育において達成するためには、単なるテキスト生成を超え、公平なデータの表現、教師の主体性、そして制度的責任を通じて、これらの言語を推論、アイデンティティ、および知的権威のための妥当なインフラストラクチャとして扱うガバナンスの枠組みを確立する必要があると論じている。
原論文は CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む
ある教室を想像してみてください。生徒が母国語で質問をすると、コンピュータープログラムが同じ言語で答えてくれる場面です。何十年もの間、人工知能の夢は、あらゆる言語を流暢に話し、人々の間の溝を埋めるユニバーサルな翻訳機として機能することでした。しかし現実の世界では、これらのコンピュータープログラムは中立的な道具ではありません。それらは膨大なテキストとデータの集合に基づいて構築されており、その多くは英語圏のソースから来ています。これが不平等な競争を生み出しています。システムが主に英語で学習されている場合、その言語においては達人となりますが、イジズール語(南アフリカの11の公用語の一つ)のような言語で推論したり、複雑な概念を説明したり、物語を語ったりすることを求められると、しばしばつまずいてしまいます。問題は単に言葉を正しくすることではありません。コンピューターがその言葉の背後にある文化、歴史、そして深い意味を理解できるかどうかという点なのです。もし機械が、その言語を英語の二流の翻訳としてしか話せないのだとしたら、その言語を思考や学習の主要な手段として使う人々に対して、敬意を欠いていることになります。
南アフリカ大学の2人の研究者、ステラ・ボランレ・アパタとイトゥメレン・I・セルトホディは、まさにこの緊張関係を調査するために着手しました。彼女たちは、特定のチャットボットがイジズール語で文章を書けるかどうかを確認するために新しいコンピューターテストを行ったのではありません。代わりに、彼女たちは44の異なる学術論文、政策文書、およびテクニカルレポートを収集し、研究することで、より大きな全体像を理解しようとしました。彼女たちは、生成人工知能(エッセイを書いたり、問題を解決したり、会話を行ったりできる種類のテクノロジー)の急速な台頭が、アフリカの言語の成長を助けているのか、それとも静かにそれらを脇に追いやっているのかを知りたかったのです。既存の知識を注意深くレビューした彼女たちの研究は、その答えは学校や政府がこれらのツールをどのように使うかという選択に完全に依存していることを示唆しています。彼女たちは、意図的な努力がなければ、これらの強力なシステムはおそらく英語の支配力を強化し、アフリカの言語を、独立した知識構築の完全な方法としてではなく、単なる英語のアイデアを翻訳するためのチャネルとして扱うだろうことを見出しました。
研究者たちはまず、技術的な側面から検討を開始しました。コンピューターは言葉の翻訳については向上しているものの、教育におけるより深い作業については依然として苦戦していることが分かりました。モデルはイジズール語で文法的に正しい文章を生成できるかもしれませんが、文化的なニュアンスや、科学的概念や歴史的事象を説明するために必要な特定の語彙に欠けていることがよくあります。これは、アフリカの言語に関するデータが不足しているために起こります。研究者たちは、これを言語自体の失敗(言語は豊かで複雑であるにもかかわらず)ではなく、デジタル・インフラストラクチャの失敗であると述べています。コンピューターは、イジズール語で考える方法を学ぶための、高品質な物語、教科書、会話を十分に「食べさせられて」いないのです。その結果、学生や教師がこれらのツールに助けを求めるとき、英語による回答の方が明確で、詳細で、信頼できると感じることがよくあります。これは、ユーザーが好んでそうしているのではなく、テクノロジーが英語を「抵抗の少ない道」にしているために、英語へと切り替えさせる微妙な圧力を生み出しています。
この研究は、技術的な不具合を超えて、人間的かつ政治的な側面を検証しています。著者らは、言語は単なるコミュニケーションの道具ではなく、アイデンティティと権威の乗り物であると主張しています。コンピューターシステムがアフリカの言語を二次的な選択肢として扱うとき、それはその言語に関連する知識や文化の価値が低いというメッセージを送ることになります。これは、研究者が「認識的不正義(epistemic injustice)」と呼ぶものです。これは、人々を思考者や知る者として不当に扱うことを指す専門用語です。もし学生が、英語の話者と同じ自信を持って、自分の母国語を使って論点を主張したり、数学の問題を解いたり、研究論文を書いたりすることができないのであれば、彼らは思想の世界への完全な参加を拒否されていることになります。研究者たちは、もし学校が計画なしにこれらのツールを単に採用すれば、この不平等を自動化してしまうリスクがあり、デジタル時代においてアフリカの言語が生き残り、繁栄することをより困難にするだろうと警告しています。
しかし、この論文は、人工知能がアフリカの言語にとって本質的に悪いものであると示唆しているわけではありません。著者らは前進するための道筋を見ていますが、それにはツールの考え方を変える必要があります。彼女らは、言語の公平性を中心に据えた、これらのシステムを統治する新しい方法を提案しています。これは、学校や大学が新しいAIツールを購入する前に、特定の質問を投げかけるべきであることを意味します。「このツールは私たちの現地語を十分にサポートしているか?」「その言語を話す人々によってテストされたか?」「このツールのためのデータを作成した人々は認識され、報われているか?」研究者たちは、教師がここで極めて重要な役割を果たすと考えています。教師は、テクノロジーの使い方だけでなく、コンピューターが間違っているときにそれを察知する方法についても訓練される必要があります。教師は、イジズール語によるAI生成の回答を見て、それがレッスンの真の意味を捉えているのか、それとも単なる浅薄な模倣に過ぎないのかを判断できなければなりません。
研究者たちはまた、責任は個人だけでなく、機関にあることも強調しています。大学や政府は、多言語主義を支持すると言いながら、詳細を運任せにしてはなりません。彼らは、AI企業に対してデータの透明性を求め、アフリカの言語のためのより良いリソース構築への投資を求める政策を作る必要があります。これには、現地の知識のデジタルライブラリの作成、これらのシステムをテストするためのより良い方法の開発、そしてこれらの言語を話す人々が設計プロセスに関与することを保証することなどが含まれます。目標は、アフリカの言語が単なる「付け足し」とされる状況から、デジタルの世界における不可欠な一部として扱われる状況へと移行することです。
結局のところ、この論文は問いを「コンピューターはイジズール語を話せるか?」から「コンピューターはイジズール語を尊重しているか?」へと再定義しています。著者らが示唆するように、その答えは単純な「はい」か「いいえ」ではありません。それは条件付きの可能性です。テクノロジーはアフリカの言語を支援し、強化する潜在能力を持っていますが、それは私たちがインフラを積極的に構築し、教師を訓練し、それを実現するための政策を策定する場合に限られます。これらのステップがなければ、南アフリカのような多言語社会における教育の未来は、英語が深刻な思考のための唯一の言語として残り、他の言語が取り残される場所になってしまうでしょう。しかし、これらのステップがあれば、人工知能は文化的記憶を保存し、すべての人々への知識へのアクセスを拡大するための強力な味方になり得ます。アパタとセルトホディの研究は、新しいテクノロジーの輝きを超えて、正義と包摂という静かで不可欠な仕事に焦点を当てるよう促す、この旅への明確なロードマップとして機能しています。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。