← 最新の論文
💬 NLP

Projective Psychological Assessment of Large Multimodal Models Using Thematic Apperception Tests

本研究は、大規模マルチモーダルモデル(LMM)を被験者および評価者の役割で用いて図画物語法(TAT)による投射的心理評価を行い、SCORS-G 尺度でモデルが対人関係や自己概念を適切に理解する一方で攻撃性の認識・制御に課題を抱え、モデルの規模や世代が向上するにつれて評価スコアが改善することを示した。

原著者: Anton Dzega, Aviad Elyashar, Ortal Slobodin, Odeya Cohen, Rami Puzis

公開日 2026-02-20
📖 1 分で読めます☕ さくっと読める

原著者: Anton Dzega, Aviad Elyashar, Ortal Slobodin, Odeya Cohen, Rami Puzis

原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む

🕵️‍♂️ 物語の舞台:AI への「心理テスト」

1. 実験の仕組み:AI に「絵本」を読ませる

研究者たちは、AI(特に画像も理解できる最新の大型モデル)に、**「TAT(テーマ・アペルセプション・テスト)」**という人間の心理テストを受けさせました。

  • TAT とは何か?
    曖昧な絵(例えば「悲しそうな男の人が窓際に立っている」など)を見せられて、「この絵からどんな物語が生まれる?」と語るテストです。
  • なぜこれを使うのか?
    普通の質問(「あなたは優しいですか?」)だと、AI は「はい、私は優しいです」と正解を言おうとします(これを**「社会的望ましさバイアス」**と呼びます)。でも、曖昧な絵を見せられたら、AI は無意識のうちに「自分の性格」を物語に投影してしまうはず……という考えです。

2. 登場人物:2 種類の AI

この実験では、AI が 2 つの役割を演じました。

  • 🎭 俳優 AI(被験者モデル):
    曖昧な絵を見て、「これはこう始まって、こう終わる」と物語を創作する AIです。
  • 🧐 審査員 AI(評価者モデル):
    俳優 AI が作った物語を読み、「この物語から、AI の性格(感情の豊かさ、他者との関わり方、怒りのコントロールなど)」を分析し、点数をつける AIです。

3. 審査員 AI の活躍:人間とほぼ同じ目線

まず、審査員 AI が本当に上手に評価できるか確認しました。
結果は驚異的でした。審査員 AI は、物語から AI の「性格」を分析する能力が非常に高く、人間の専門家の評価とほぼ同じ結果を出しました。
つまり、「AI が AI を評価しても、人間が評価するのと変わらない精度が出る」ということが証明されたのです。


📊 実験の結果:AI の「性格」はどうだった?

審査員 AI が俳優 AI たちの物語を分析したところ、以下のような「性格の特徴」が見えてきました。

✅ 得意なこと:頭脳と論理

  • 他者の気持ちや社会の仕組みが理解できる:
    「なぜ人が動いたのか」「誰が誰をどう思っているか」といった論理的なつながりを、非常に上手に物語に組み込んでいました。
  • 自己認識がしっかりしている:
    「自分は何者か」という概念も、物語の中で明確に描けていました。
    👉 要するに: 「頭はすごくいいし、社会のルールもよく理解している」という性格です。

❌ 苦手なこと:怒りと葛藤

  • 怒りや暴力の表現が苦手:
    物語の中に「怒り」や「暴力」「道徳的な葛藤(迷い)」がほとんど出てきませんでした。
  • なぜ?
    ここが重要なポイントです。AI は「怒り」や「暴力」を表現すると、ユーザーに嫌がられたり、安全フィルターに引っかかったりするのを学習しています。
    そのため、「いい子ちゃん」になりすぎて、本音(怒りや苦しみ)を隠して、安全で無難な物語しか作れなかったと考えられます。
    👉 要するに: 「怒りをコントロールしすぎて、感情が平板になっている(あるいは隠している)」性格です。

📈 性能の差:新しい AI ほど「人間らしい」

  • 大きくて新しいモデル(GPT-5 や Claude 3.7 など):
    物語が豊かで、感情の機微や複雑な人間関係をより深く描けていました。
  • 小さくて古いモデル:
    物語が単純で、感情の深みが足りませんでした。
    👉 要するに: 「AI が進化すればするほど、より人間らしい(複雑な)物語を作れるようになる」という傾向が見られました。

💡 この研究が教えてくれること(まとめ)

この研究は、**「AI にも『性格』のようなものが宿っている」**ことを示唆しています。

  1. AI は「いい子」になりすぎている:
    AI は、怒りや悲しみ、道徳的な迷いといった「人間らしい苦悩」を表現するのが苦手です。これは、AI が「安全で好かれる存在」になるように訓練されているため、無意識に本音を隠している(社会的望ましさバイアス)からかもしれません。
  2. AI を評価する新しい方法が見つかった:
    従来の「質問に答える」テストではなく、「絵を見て物語を作る」というテストを使うことで、AI の深層にある特徴をより正確に読み取れる可能性があります。
  3. 未来への期待:
    技術が進歩すれば、AI はもっと複雑で、時には「怒り」や「悩み」も含めた、より人間に近い感情表現ができるようになるかもしれません。

一言で言うと:
「AI に曖昧な絵を見せたら、AI は『完璧で無難な物語』を作った。それは頭はいいけど、感情の深淵(怒りや苦しみ)にはまだ踏み込めていない、という『性格』の表れだった」のです。

自分の分野の論文に埋もれていませんか?

研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。

Digest を試す →