← 最新の論文
🧬 biology

Shared representations in brains and models reveal a two-route cortical organization during scene perception

7T fMRI データを表現類似性分析により解析した本研究は、風景知覚が環境文脈のための内側腹側経路と生体内容のための外側経路という 2 つの異なる皮質経路に依存することを明らかにし、これら両経路はビジョンモデルに反映されている一方、言語モデルは主に生体内容経路と整合することを示している。

原著者: Pablo Marcos-Manchón, Lluís Fuentemilla

公開日 2026-05-15
📖 1 分で読めます☕ さくっと読める

原著者: Pablo Marcos-Manchón, Lluís Fuentemilla

原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 ⚕️ これは査読を受けていないプレプリントのAI生成解説です。医学的助言ではありません。この内容に基づいて健康上の判断をしないでください。 免責事項の全文を読む

あなたの脳を、視覚情報(あなたが目にするもの)が主要な駅に到着する、巨大で賑やかな都市だと想像してみてください。長年、科学者たちはこの都市に2本の主要な高速道路があると考えていました。一つは「何」の物体か(カップや犬など)を識別するためのもので、もう一つはそれらが空間の「どこ」にあるかを特定するためのものでした。

この論文は、この都市の地図は実際にはもっと複雑であると示唆しています。高解像度の脳スキャンを用い、それを強力なコンピュータの「脳」(AI モデル)と比較することで、研究者たちは私たちが自然な風景を見たとき、視覚野が単に「何」と「どこ」を処理するのではなく、異なる種類の情報を処理する2 つの明確な経路に分かれることを発見しました。

以下に、彼らの発見を簡単なアナロジーを用いて解説します。

1. 視覚の2本の高速道路

あなたが複雑な風景(人、木、湖がある公園など)を見たとき、あなたの脳はそれを1 つの大きな塊として処理するわけではありません。情報は2 つの別の「高速道路」へと送られます。

  • 「風景」ルート(内側・腹側): この経路は視覚処理領域の中央下部を走ります。それは建築家であり、観光ガイドです。環境のレイアウト、壁、地平線、部屋の形状、そして一般的な文脈に特化しています。それは「ここはどんな場所か?」という問いに答えます。
    • アナロジー: これは、誰がそこに立っているかに関係なく、物体や空間の配置に基づいてあなたが「キッチン」や「森」にいることを認識する、あなたの脳の部分だと考えてください。
  • 「生命」ルート(外側): この経路は視覚処理領域の側面を走ります。それは社会的な観察者です。人、動物、動きといった生き物に極端に集中しています。それは「この風景に誰、または何が生きているか?」という問いに答えます。
    • アナロジー: これは、背景の木々を無視しても、犬を散歩させている人や飛んでいる鳥を瞬時に見つける、あなたの脳の部分です。

2. AI 比較(「鏡テスト」)

これらの経路が存在し、何をしているのかを理解するために、研究者たちは人間の脳活動と2 種類の人工知能を比較しました。

  • ビジョンモデル(画像で訓練された AI): これらはピクセルを見るだけで形状や物体を認識することを学ぶカメラのようなものです。
  • 言語モデル(テキストで訓練された AI): これらは言葉や概念を使って物事を記述することを学ぶ作家のようなものです。

結果:

  • 「風景」ルートは、ビジョンモデルと完全に一致しました。それは写真のレイアウトを分析するカメラのように、風景の視覚的構造(レイアウト)に関心を持っています。
  • 「生命」ルートは、ビジョンモデル言語モデル両方と一致しました。これは驚くべきことで、つまりこの脳の部分は、私たちが言葉でそれらを記述する方法に似て、「生きているコンテンツ」(人や動物)に同調していることを意味します。まるでこの脳領域が、顔を見ることと「人」という言葉を読むことの両方に合致する形で、「あれは人だ」と考えているかのようです。

3. 「生物学的エージェント」スイッチ

研究者たちは、「生命」ルートが非常に特異的であることを発見しました。

  • アナロジー:「生命」ルートは、生きている存在を検出したときだけ作動するセキュリティカメラだと想像してください。
  • 研究者が、人や動物を含まない画像(風景や物体のみ)を脳に提示すると、このルートは静かになりました。
  • 人か動物が含まれる画像を提示すると、このルートは強く点灯しました。
  • これは、この特定の高速道路が、ほぼ完全に社会的および生物学的なコンテンツの処理に専念していることを示唆しています。

4. なぜこれが重要なのか(論文によると)

この論文は、私たちの脳が単に「物体」と「場所」に物を分類しているわけではないと主張しています。代わりに、それらは**「文脈/環境」「生命/社会的コンテンツ」**に分類されています。

  • 文脈ルートは、あなたが立っているステージ(部屋、風景)を理解するのを助けます。
  • 社会的ルートは、そのステージ上の俳優(人、動物)を追跡するのを助けます。

この論文が主張していないこと

著者たちが実際に発見したことに忠実であることが重要です。

  • アルツハイマー病や自閉症のような病気の診断に役立つとは言っていません(将来的なアイデアかもしれませんが、この論文には含まれていません)。
  • より良いロボットを構築するためにこれを使えるとは言っていません(これも将来的なアイデアであり、ここでは主張されていません)。
  • これはあらゆる種類の視覚タスクに機能するとは言っていません。彼らは具体的に自然な風景(現実世界の環境の写真)でこれをテストしました。白い背景の上に単一の孤立した物体を見ている場合、この「2 つの経路」の分割は異なるように見えるかもしれません。

まとめ

あなたの脳の視覚システムを映画館だと考えてみてください。

  • 一方のプロジェクター(風景ルート)は、セットデザイン(背景、部屋、風景)に焦点を当てます。
  • もう一方のプロジェクター(生命ルート)は、俳優(人と動物)に焦点を当てます。
  • この論文は、これら2 つのプロジェクターが明確で専門化されており、私たちに世界の完全な像を与えるために協力して機能していることを示しています。また、コンピュータ AI も、このように分かれた世界を見る方法を学び始めていることを示しています。

自分の分野の論文に埋もれていませんか?

研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。

Digest を試す →