AI systems and the reproduction of (standard) language ideologies in World Englishes
本論文は、AIシステムがその設計と使用の両面において、インナー・サークルの規範を特権化し非主流の英語を周縁化することで、標準的な言語イデオロギーを再現していると論じるとともに、言語を均質化すると同時に複数化させるという「標準化のパラドックス」を通じて、ワールド・イングリッシュにおける言語的正当性と所有性をめぐる論争を再燃させていることを論じるものである。
原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む
英語という言語を、巨大で賑やかな一つの都市だと想像してみてください。長い間、都市計画家たち(教師、編集者、辞書編纂者)は、特定の唯一の地区、すなわち「標準」地区こそが、真実かつ正しい都市であると決定してきました。他のすべての地区、つまり独自の俗語やアクセント、文法を持つ地区は、「乱れた」もの、あるいは「正しい」ものの不完全なバージョンとして扱われてきました。この考え方は「言語イデオロギー」と呼ばれます。これは、どの話し方が「良く」、どの話し方が「悪い」かについての信念のセットであり、しばしば人々の知性や価値を判断するために用いられます。
ここで、新しい都市計画家が登場します。人工知能(AI)です。これらは大規模言語モデル(LLM)と呼ばれる巨大なコンピュータの脳であり、話し方を学ぶためにインターネット上のほぼすべての情報を読み込んできました。あなたはこう思うかもしれません。「素晴らしい!彼らがすべてを読んだのなら、あらゆる地区のスタイルを学べるはずだ!」しかし、ここにひねりがあります。これらのAIの脳は、古い設計図に基づいて作られています。彼らは「標準」地区こそが唯一重要であると考えがちであり、他の人々の話し方を「間違い」として扱うことがよくあります。この論文は、大きな問いを投げかけます。これらのAIツールは、単に古い不公平なルールを模倣しているだけなのか、それとも、偶然にもすべての異なる地区の声がようやく届くような空間を作り出しているのでしょうか?
AI都市計画家と「デルブ(delve)」探偵物語
キングスレー・ウグワニ(Kingsley Ugwuanyi)によって書かれたこの論文は、AIシステムがいかに英語の厳格な門番として振る舞っているかを調査しています。著者は、AIは中立的なツールではなく、「イデオロギーを持つ主体」であると主張しています。AIを、非常に高速で自信満々なロボットシェフだと考えてみてください。もし、そのレシピ本(学習データ)が主にイギリスやアメリカの高級レストランのレシピばかりで構成されていたら、そのロボットは、それらのレシピこそが「本物の料理」であると信じるようになります。もしあなたが、ナイジェリアやインドの屋台の料理を作ってほしいと頼んだら、ロボットは混乱するか、あるいはさらに悪いことに、本来の味ではなく高級レストランの味にしてしまうために、場違いな材料を加えて「修正」しようとするかもしれません。
この論文は、AIシステムがその創造のあらゆる段階において、どのように「標準言語イデオロギー」を再現しているかを明らかにしています。
- 学習データ: AIが読む「レシピ本」は、「インナーサークル(中心圏)」(アメリカ、イギリスなど)からのテキストで溢れています。これにより、AIはこれらの国々での話し方が「デフォルト(標準)」であり、それ以外のすべては「グリッチ(不具合)」であると考えるようになります。
- テスト: 科学者がAIが賢いかどうかをテストする際、標準的なアメリカ英語で書かれた試験を用います。もしAIが、アフリカ系アメリカ人英語(AAVE)やナイジェリア英語で書かれた質問に答えようとした場合、AIは失敗するか、失礼で混乱した回答を出すことがよくあります。それは、運転免許の試験を、そのドライバーが話せない言語で行い、その上で「そのドライバーは下手だ」と言うようなものです。
- 人間の手による調整: 人間がAIの学習を助ける際(間違いを修正する場合)、彼らはしばしば、AIを「正しく」聞こえるようにするよう指示されます。これは通常、非標準的な英語から独特の風味を削ぎ落とし、AIをジェネリックで洗練された、グローバル・ノース(北半球の先進国)出身のロボットのように強制的に作り変えることを意味します。
「デルブ(delve)」論争:言葉が罪となる時
これが現実の世界でどのように展開されるかを示すために、この論文はある一つの単語、**「delve(深く掘り下げる、探求する)」**についての魅力的な物語を伝えています。
最近、AIチャットボットが「delve」という言葉を好んで使うことに人々が気づき始めました。すぐに、オンライン上で不満の波が広がりました。アメリカやイギリスの人々は、「もし『delve』という言葉を使うなら、お前はロボットに違いない!」と言い始めました。彼らは、その言葉を、偽物の書き手であることを露呈させる秘密のコードのように扱いました。
論文は、この反応こそが実は「罠」であることを指摘しています。
- 非難: 一部の評論家は、AIが「delve」を多用しているのは、アフリカ英語の話し手がその言葉を使いすぎているという主張を模倣しているからだと主張しました。彼らはこれを「侮辱」と呼び、AIがアフリカ出身であるかのように振る舞うことは良くないのだと示唆しました。
- 現実の検証: 著者がデータを調べたところ、「delve」はAIが存在するずっと前から、アジアやアフリカを含む多くの地域でかなり頻繁に使用されていたことが分かりました。その言葉は「AIっぽい」ものではなく、一部の人々が使うごく普通の言葉だったのです。
- バックラッシュ(反発): グローバル・サウス(ナイジェリアやインドなど)の人々がこれらの不満を目にしたとき、彼らは強く反発しました。彼らは、自分たちが学校で「delve」のような言葉を使うよう教えられてきたことを指摘しました。彼らは、自分たちの英語を「偽物」や「AI生成」と呼ぶことは、「お前の英語は我々にとって十分ではない」と言うことの現代版であると主張しました。それは、何が「本物の」英語で、何が「疑わしい」ものかを、力を持つ国の人々が決めるという、植民地時代の取り締まりの現代版なのです。
論文は、これは単なる言葉の問題ではなく、**「誰が決めるのか」**という問題であると示唆しています。裕福なアメリカの投資家が、「delve」を使うことは不正の証拠だとツイートするとき、彼は自分の権力を使って他人の話し方を取り締まっているのです。論文は、AIが、英語の所有権をめぐる古い議論が再び繰り広げられる新たな戦場となっていることを示しています。
「標準化のパラドックス」:希望の兆し?
すべてが暗い展開なのでしょうか? 論文は、**「標準化のパラドックス」**と呼ばれる奇妙な展開を示唆しています。
巨大な鏡(AI)を想像してください。片側では、鏡はただ一つの完璧な標準的な顔(アメリカ/イギリス英語)を示すように磨かれています。これにより、英語はより均一で退屈なものに見えます。しかし、もう片側では、鏡があまりにも巨大で、膨大な量の異なるデータ源を反射しているため、あらゆる他の顔の断片をも映し出し始めています。
- 良いニュース: AIはあらゆる場所からの膨大なデータで訓練されているため、かつてないほど多様な英語に触れています。一部の研究者は、システム全体を壊すことなく特定のダイアレクト(方言)をAIに教えるための「アダプター」(プラグインのようなモジュール)を構築しようとしています。
- 悪いニュース: 論文は、これがAIが突然公平になったことを意味しないと警告しています。AIを訓練している人々は、しばしば非常に低い賃金で働かされ、自身の言語の特性を消し去る厳しいルールに従わされています。そのため、AIは多様性を「聞き取って」はいるものの、実際には標準化された西洋的な声で「話す」ことになるのです。
なぜこれがあなたにとって重要なのか
論文は、これはコンピュータ科学者にとっての技術的な問題ではなく、現実世界の人々にとっての問題であると結論づけています。もしAIチューターがナイジェリア英語を理解できなければ、その学生は落第するかもしれません。もしAI採用ツールがインド英語で書かれた履歴書を拒絶すれば、その人は仕事を失うかもしれません。もし音声レコーダーが先住民コミュニティの長老の言葉を理解できなければ、彼らの歴史は失われてしまうかもしれません。
著者は、AIを中立的なツールとして扱うのをやめ、それが古い偏見を強化することもあれば、より包括的な世界を築く助けにもなるシステムであると捉えるべきだと主張しています。課題は、英語が単一の言語であり、唯一の「正しい」話し方があるのではなく、多様で等しく妥当な多くの言語からなる一つの家族であることを、これらのシステムに認識させるように設計することです。レシピ本と味のテスターを修正しない限り、AIはこれまでと同じ、排他的なメニューを提供し続けることになるでしょう。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。