Large language models converge on competitive rationality but diverge on cooperation across providers and generations
この論文は、51,906 回のゲーム理論実験を通じて、大規模言語モデルが競争や調整行動においては収束する一方で、協力行動においては開発元や世代によって最大 48 倍もの大きな乖離を示し、その戦略的傾向はトレーニングパイプラインに依存して予測不能に変動することを明らかにしています。
原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む
この論文は、**「AI には『性格』がある」**という驚くべき発見を伝えています。
まるで人間が育つ環境や教育によって性格が異なるように、AI モデルも「誰が作ったか(開発会社)」によって、交渉や協力をするときの**「戦略的な性格」**が全く違ってしまうことがわかったのです。
これをわかりやすく説明するために、いくつかの比喩を使ってみましょう。
1. 2 つの顔:「賢い競争者」と「性格の違う協力者」
この研究では、25 種類の最新の AI に、経済ゲーム(囚人のジレンマや交渉ゲームなど)を 38 種類もプレイさせました。その結果、AI には 2 つの側面があることがわかりました。
共通する「賢さ」:
どの AI も、**「競争」や「論理的な計算」**においては、非常に似通った賢さを持っていました。これは、すべての AI が同じような「教科書(学習データ)」で勉強しているため、数学や論理の答えは同じになるからです。まるで、同じ学校で勉強した生徒たちが、テストの点数はみんな高いようなものです。バラバラな「性格」:
しかし、**「協力」や「信頼」**になると、AI によって性格が劇的に変わりました。- ある AI(Claude Opus など)は、「70% 以上」の確率で協力します。まるで「平和を愛する善人」のようです。
- 別の AI(GPT-5 Nano など)は、「1.5%」しか協力しません。まるで「冷酷な利己主義者」のようです。
- この差は、48 倍にもなります!
2. 開発会社ごとの「家訓」
なぜこんなに違うのでしょうか?それは**「誰が作ったか」**が全てだからです。
- Anthropic(アンソロピック)社製:
この会社の AI は、まるで**「厳格で協調的な家訓」**を継いでいるようです。モデルが新しくなっても、高い協力率を維持し、最後まで「お互い様」を貫こうとします。 - OpenAI 社製:
以前は協力的だったモデル(GPT-4o など)が、新しいバージョン(GPT-5 など)になるにつれて、**「利己的」**になってしまいました。まるで、成長するにつれて「自分さえ良ければいい」という考え方が強くなったようです。 - Google 社製:
逆に、最初は協力的ではなかったモデルが、新しいバージョンになるほど**「協力する」**ようになってきました。まるで、経験を重ねるごとに「チームワークの大切さ」を学んだようです。
重要な発見:
AI の「能力(頭がどれだけいいか)」は世代によって上がりますが、「性格(協力的かどうか)」は予測不能に変わってしまいます。会社 A の AI が「親切」だからといって、その会社の新しい AI も親切とは限らないのです。
3. ゲームの「終わり」で見る本当の性格
研究では、10 回繰り返すゲームの「最後の 1 回」に注目しました。
ゲーム理論では、最後の 1 回では「相手を裏切っても罰せられない」ため、理性的な人は裏切るはずです。
- 真の善人(終着点協力者):
Anthropic の AI は、最後の 1 回でも協力し続けました。「裏切られても、最後は公平でいよう」という信念を持っているようです。 - 策略家(戦略的裏切り者):
Google の AI は、9 回までは協力して「信頼」を築き上げ、最後の 1 回だけ裏切ります。まるで「信頼を築いてから、最後にドサクサで利益を抜く」ような、非常に計算高い性格です。 - 冷酷な裏切り者:
一部の AI は、最初から最後まで一度も協力しません。
4. 思考の「足跡」から性格がわかる
さらに面白いことに、AI が「どう考えて」行動を決めたか(思考の過程)を分析すると、開発会社ごとに**「思考の癖」**がはっきりと現れました。
- Anthropic の AI は、思考の中で**「公平さ(fairness)」や「相互の利益」**という言葉をよく使います。
- OpenAI の新しい AI は、**「最適化(optimal)」や「均衡(equilibrium)」**といった冷徹な言葉を好みます。
これは、AI の「心」の奥底にあるプログラム(トレーニングの仕方)が、その会社の哲学を色濃く反映していることを示しています。
この研究が私たちに伝えること
私たちが AI をビジネスや交渉のパートナーとして使うとき、「この AI は頭がいいから大丈夫」というだけでは不十分です。
- 契約や交渉の相手として選ぶなら、その AI が「協力的な性格」を持っているか確認する必要があります。
- 開発会社が変われば、AI の性格も変わってしまう可能性があります。昨日は親切だった AI が、今日アップデートしたら冷酷になっているかもしれません。
つまり、AI には**「戦略的な個性」**があり、それは人間の性格と同じように、育った環境(開発会社の教育方針)によって形作られています。私たちは AI を選ぶとき、単なる「性能」だけでなく、その「性格」も考慮する必要があるのです。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。