LLMs Generate Kitsch
本論文は、大規模言語モデル(LLM)の出力が一般的で空虚であると知覚される根源は、その訓練方法論に起因するキチシュの体系的な生成にあり、読者が人間による作品よりも LLM によって生成された物語をよりキチシュ的であると知覚することを示す実証的証拠がこの主張を裏付けていると論じる。
原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む
「LLM はキチシュを生成する」という論文を、平易な言葉と日常的な比喩を用いて解説します。
大きなアイデア:「完璧な」コピー対本物
美術館に入ると想像してください。一方には、何年もかけて自らの感情と格闘し、考えさせられる奇妙で困難な何かを描いた著名な画家の絵画があります。他方には、何百万点もの他の絵画を研究し、「人々は夕焼けと悲しげな表情が好きだから、完璧な夕焼けに悲しげな表情をつけよう」と判断して作られた、古典的名作と全く同じように見える絵画があります。
機械の描いた絵は技術的に完璧です。間違いはありません。美しいです。しかし、ガソリンスタンドで買うグリーティングカードのように、少し空虚に感じられます。この論文の著者たちは、この感覚を**「キチシュ」**と呼んでいます。
キチシュとは、芸術のように見えるが、実際には安価で大量生産された模倣品であり、深く考えさせることなく、誰もがすぐに簡単に感じられる感情(「あ、かわいい」「ああ、悲しい」など)を引き起こすように設計されたものです。
この論文は、今あなたとお話ししているような大規模言語モデル(LLM)は、基本的に「キチシュ製造機」であると主張しています。それらは真の芸術を生み出すのではなく、高品質で空虚なコピーを生み出します。
なぜ LLM はキチシュを作るのか?
著者たちは、これは偶然ではなく、機械の仕組みそのものによるものだと述べています。いくつかの単純な比喩を用いて、3 つの理由を挙げています。
1. 機械には魂がない(意図がない)
あなたが言ったどんな文も繰り返せるオウムを想像してください。オウムに失恋についての詩を書くように頼めば、以前聞いたことがある言葉を使って、失恋に「聞こえる」言葉を言います。しかし、オウムは実際には悲しんでいません。内面的な生活を持っていないのです。
- 論文の主張: LLM も同じように機能します。通常、次に何が来るかに基づいて次の単語を予測します。感情も記憶も、書く理由も持っていません。人間感情の「形」を模倣しているだけで、「実体」は欠落しています。
2. 機械は安全策を取る(慣習的な表面)
必ず人気が出る料理だけを調理するシェフを想像してください。彼らは人々を混乱させるかもしれない奇妙で実験的な味付けを試すことは決してありません。誰もが大好きだと知っている「クラシックな」ラザニアだけを調理するのです。
- 論文の主張: LLM は、最も可能性の高い次の単語を予測するように訓練されています。这意味着、彼らは自然と奇妙でリスクのある、あるいは革新的なアイデアを避けます。物語を語る方法や詩を書く方法において「標準的」なやり方に固執します。これにより出力は読みやすく理解しやすくなります(これは良いことです!)が、同時に、真の人間の創造性にある独特で驚くべき火花が欠如していることを意味します。
3. 機械は好かれたい(大衆的アピール)
ジョークを言うコメディアンを想像してください。もし彼が全員を笑わせたいなら、猫やピザに関する安全で一般的なジョークを言うでしょう。あまりにも具体的で奇妙なジョークを言えば、笑うのは数人だけかもしれません。
- 論文の主張: LLM は、「人間のフィードバックによる強化学習(RLHF)」という手法で訓練されることがよくあります。これは、人間が「その答えが好きだ」と言うたびに、ロボットに金メダルを与えるようなものです。ロボットは、金メダルを得るためには、可能な限り広い層にアピールする内容を言う必要があると学びます。これにより、ロボットは複雑で挑戦的なものではなく、懐古主義やロマンスのような簡単な感情を誘発する「安全で」一般的なコンテンツを生み出すように強制されます。
実験:人々は気づくか?
著者たちは推測しただけではなく、テストを行いました。
設定:
彼らは、ある書き言葉コンテストから選ばれた 10 編の人間による短編小説を取り、AI に同じアイデアに基づいて新しい物語を書くよう求めました(ただし、元の作品は見せないようにしました)。その後、100 人以上の人々にこれらのペアを読んで、「キチシュ」(偽物、空虚、あるいは過度に感傷的)のどちらだと推測させました。
結果:
- 人々は偽物を見抜いた: 人々に「キチシュ」を「感傷的」または「読みやすい」と定義するように求めたところ、AI の物語をキチシュとして正しく特定したのは約**85%**でした。彼らは AI の物語が「ガソリンスタンドのグリーティングカード」であると見分けることができました。
- しかし、人々は偽物の方を好んだ: ここにひねりがあります。人々が AI の物語が「キチシュ」だと知っていながら、それでも読むことを好んだのです。約 67% の場合、人々は人間による物語よりも AI の物語の方を楽しんだと答えました。
比喩:
これは、完璧に設計された糖分の多いキャンディバーを食べるのと、複雑で苦いダークチョコレートを食べるのと似ています。
- **キャンディバー(AI/キチシュ)*は甘く、食べやすく、即座に糖分のハイを与えます。その瞬間にはより*楽しんでしまいます。
- **ダークチョコレート(人間の芸術)**は消化しにくく、少し苦く、味わうことを要求します。より多くの「栄養価」(芸術的深さ)を持っていますが、即座に満足感を与えるわけではありません。
これは何を意味するのか?
この論文は、いくつかの重要な教訓で結論付けています。
- 「AI スロップ」の問題: 外見は素晴らしいが中身が空虚な AI コンテンツの洪水が見られます。これは、AI が深遠さではなく人気を追求するように設計されているためです。
- 「好きだったか?」だけ聞かないこと: 研究者が AI が芸術創造において優れているかどうかを知りたい場合、「どちらを楽しんだか?」と人々に聞くだけではなりません。なぜなら、人々はしばしば「キチシュ」の方を好むからです。作品の質と独自性について、より深い問いを立てる必要があります。
- 人間のタッチはまだ必要: 著者たちは、AI は標準的なコードスニペットや基本的な物語のあらすじといった「退屈な」部分には優れているが、真に芸術的、科学的、あるいは革新的な何かを望むなら、人間が運転席に座る必要があると提案しています。機械に全行程を運転させれば、ただ非常に滑らかで非常に退屈な、どこにも着かないドライブになるだけです。
要約: LLM は、私たちが即座に良い気分になる「完璧な」コピーを作るのが得意ですが、私たちに考えさせるような、厄介で困難で独特な何かを作るのは苦手です。彼らはキチシュの究極の達人です。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。