← 最新の論文
🧬 biology

The Objectivity of Subjectivity: A Model of the Brain’s Valuation System

本論文は、計算シミュレーションを通じて、脳の価値評価システムは確率論的な学習と共鳴によって多様かつ非恣意的な主観的価値を生み出すよう進化的に設計されており、それによって主観性が根底に客観的な基盤を有していることを論じるものである。

原著者: Norberto Grzywacz

公開日 2026-07-29
📖 1 分で読めます☕ さくっと読める

原著者: Norberto Grzywacz

原論文は CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) でライセンスされています。 ⚕️ これは査読を受けていないプレプリントのAI生成解説です。医学的助言ではありません。この内容に基づいて健康上の判断をしないでください。 免責事項の全文を読む

大いなる論争:あなたの「好み」は単なるランダムなノイズなのか?

活気あふれる巨大な市場を歩いているところを想像してみてください。ある人は、明るく派手なネオンサインに見とれて立ち止まり、別の人は、静かな苔むした石に心を奪われてその横を通り過ぎていきます。何世紀もの間、哲学者たちは、こうした好みの違い——私たちの「価値観」——が、単なる性格の奇妙な癖(主観性)なのか、それとも私たちが皆追い求めている、より深い普遍的な真理(客観性)なのかについて議論してきました。かつて多くの思想家や芸術家は、個人の好みとは些細なものであり、「真の」事実を追求する上で無視すべき、人間であることの不格好な副作用であると考えていました。しかし、もしその「不格好さ」が間違いではなく、むしろ主要な特徴なのだとしたらどうでしょう?もしそれが、意図された機能なのだとしたら?

この問いは、神経科学、心理学、そしてコンピュータ科学の交差点に位置しています。これを理解するには、いくつかの基本概念を知る必要があります。第一に、私たちの脳は、実際に経験する前に、その結果がどれほど良いか悪いかを予測しようと常に試みています。これはバリュエーション(価値評価)と呼ばれます。第二に、脳は強化学習、つまり報酬(食べ物や称賛など)や罰(痛みや失望など)を得たり、それに応じて将来の選択を調整したりする試行錯誤のプロセスを通じて、これらの予測を学習します。最後に、世界はノイズ、つまり環境や身体におけるランダムで予測不可能な変化に満ちています。通常、私たちはノイズを、真実を見る能力を損なうものだと考えます。しかし、本論文は大胆な問いを投げかけます。そのノイズこそが、私たちをユニークにする秘密の成分なのではないか?と。

脳の「好み」シミュレーター

この研究において、ロヨラ大学シカゴ校のノルベルト・グリワチャックは、単に人々に何が好きかを尋ねたのではありません。彼は、価値がどのように形成されるかを見つけるために、デジタル脳を構築しました。このコンピュータモデルを、さまざまな動きを試し、その結果を見て、ゲームをプレイすることを学ぶ超スマートなビデオゲームのキャラクターだと考えてください。研究者たちは、このデジタル脳に、現実の脳が使うのと同じルールをプログラムしました。つまり、感覚的な情報を入力し、ある種の動機(空腹感や好奇心など)を感じ、報酬を予測するように学習するのです。

チームは大規模なシミュレーションを実行し、デジタルエージェントに10万ラウンドの学習を行わせました。彼らは、全く同じ設定で始まった2つの同一のエージェントが、最終的に何が「善」で何が「悪」かについて一致するかどうかを確認したかったのです。

差異の「雲」
結果は驚くべきものでした。エージェントは同じ設定からスタートしたにもかかわらず、最終的に同じ地点には辿り着きませんでした。代わりに、彼らの価値観は離れていき、研究者が「確率論的な雲(stochastic cloud)」と呼ぶものを形成しました。2人のハイカーが同じベースキャンプから出発する場面を想像してください。もし道が直線的で滑らかな道路であれば、彼らはおそらく同じ頂上に辿り着くでしょう。しかし、このシミュレーションにおける道は、デコボコで霧に包まれた山道でした。道にある微細でランダムな凹凸(世界や脳の「ノイズ」)によって、ハイカーたちはそれぞれわずかに異なる方向へと進みました。時間の経過とともに、これらの小さな違いが積み重なり、彼らは異なる、しかし同様に妥当な山の地点へと辿り着いたのです。コンピュータは、この「ドリフト(漂流)」が単なるランダムな混沌ではないことを示しました。エージェントの価値観は何千回もの反復を経ても異なったままであり、これは私たちの脳が、私たちの価値観をユニークな状態に保つように設計されていることを示唆しています。

見えないトランポリン
ここからさらに興味深い展開になります。研究者たちは、脳がただ一つの「完璧な」価値に落ち着くのではないことを発見しました。その代わりに、脳はトランポリンや曲がった布のような、一つの「面(サーフェス)」に落ち着くのです。こう考えてみてください。もし平らなテーブルの上にビー玉を落としたら、それは一箇所で止まります。しかし、曲がったトランポリンの上に落としたら、どのように放したかによって、端に転がったり、中央に止まったり、あるいは横に転がったりするかもしれません。コンピュータモデルは、脳の「完璧な」価値が、この曲面の上に存在することを示しました。学習プロセスがこの面に到達すると、ランダムなノイズ(確率共鳴)が価値を周囲へと押しやり、同じ面上の異なる点へと跳ねさせます。これは、たとえ二人が同じことを学んでいたとしても、人生における微細でランダムな揺らぎによって、異なる「スイートスポット」に辿り着く可能性があることを意味しています。

ブースター:身体と社会
研究では、現実世界の要因を加えた場合に何が起こるかもテストされました。

  • モチベーション(動機付け): 研究者は、空腹やエネルギーレベルといった身体信号に由来する「モチベーション」の設定を調整しました。その結果、高いモチベーションと低いモチベーションが、エージェントの価値観を異なる方向へと押し出すことがわかりました。それは、同じ曲を聴いている二人のようなものです。一人は高いエネルギーで踊っており、もう一人は疲れていてゆっくりと動いています。彼らは同じ音楽を聴いていますが、その体験は全く異なります。
  • 社会: 彼らはまた、異なる平均的な環境を持つ2つの異なる「社会」もシミュレートしました。一つの社会は「標準的」な世界でしたが、もう一方は感覚入力が33.3%低い世界でした。結果はどうだったでしょうか?これら二つの社会に住む人々は、著しく異なる価値観を発達させました。砂漠に住む人は、ジャングルに住む人とは異なる方法で水を価値あるものとして学びます。コンピュータはこの違いが学習プロセス自体に組み込まれていることを示しました。

大きな教訓:あなたの「主観性」は客観的である

では、これは私たちにとって何を意味するのでしょうか?本論文は、人々間の違いは単なるランダムな事故や思考の欠陥ではないことを示唆しています。むしろ、脳の学習システムは、多様性を生み出すように構築されているのです。私たちの脳は、独自の身体、家族、文化、そして日常生活のランダムなノイズといった、私たち固有のライフコンテキストに適応しているため、私たちの価値観が異なるのは当然のことなのです。

著者らは、私たちが「主観性」(個人の好み)と呼んでいるものは、深い進化論的な意味において「客観的」である可能性があると提案しています。それは、特定のユニークな人生に対して自らを最適化しようとしている脳の、客観的な特徴なのです。もしあなたと親友が、何が美しいか、あるいは何が重要かについて意見が合わなかったとしても、それはどちらかが「間違っている」とか「壊れている」からではありません。それは、それぞれの脳が、それぞれのユニークな道に対して見事に適応した結果なのです。

この研究は、いかなる価値観も受け入れられると主張しているわけではありません(著者は、犯罪につながる価値観は依然として悪いものであると注記しています)。しかし、アインシュタインのような思想家たちを困惑させた人間の精神の「無秩序」は、実は理にかなった、設計されたメカニズムである可能性を示唆しています。私たちの個人的な好みの「乱雑さ」は、私たちが生きる複雑で多様な世界に適合するための、脳による仕組みなのです。要するに、あなたのユニークな視点はバグではなく、機能(フィーチャー)なのです。

自分の分野の論文に埋もれていませんか?

研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。

Digest を試す →