Striatal interneuron microcircuits gate reinforcement to stabilize adaptive choice
本研究は、即時的な試行結果を安定した適応的な行動方策へと変容させるために、強化信号を制御する、チロシン水酸化酵素およびソマトスタチン介在ニューロンが関与する背内側線条体内の脱抑制マイクロ回路を特定している。
原論文は CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは査読を受けていないプレプリントのAI生成解説です。医学的助言ではありません。この内容に基づいて健康上の判断をしないでください。 免責事項の全文を読む
私たちは毎日、通勤のルートを決めることからメニューから食事を選ぶことまで、数え切れないほどの小さな選択を行っています。これらの選択の中には、試行錯誤を通じて学んだものもあります。これは、私たちの脳が行動の結果に対して成功や失敗を天秤にかけるプロセスです。この学習は、報酬と罰に関する情報を処理するハブとして機能する深部構造である、線条体と呼ばれる脳の特定の領域で行われます。このハブ内では、スパインを持つ投射ニューロンと呼ばれる種類の神経細胞が主要なメッセンジャーとして機能し、私たちの行動を前へと進める信号を送っています。科学者たちは、これらのメッセンジャー細胞が興奮性の入力によって制御されていることを古くから理解してきましたが、線条体内部でブレーキやフィルターとして機能する局所的な抑制細胞の役割については、謎のまま残されてきました。これらの局所的なブレーキがどのように機能するかを理解することは極めて重要です。なぜなら、それらが、世界のルールが変わったときに、私たちの習慣をいかに適応させるか(古いやり方が通用しなくなったときに、新しい戦略へと移行するか)という鍵を握っている可能性があるからです。
研究チームは最近、局所的な抑制回路が学習にどのように影響を与えるかを明らかにするため、背内側線条体に注目しました。彼らは、報酬を得るためにレバーを押すか引く必要がある学習課題に焦点を当てましたが、そのゲームのルールは時折反転しました。時には押すことが正解であり、時には引くことが正解であり、動物は報酬を受け取ったかどうかに基づいてその変化を判断しなければなりませんでした。このプロセス中のさまざまな抑制性神経細胞の活動を観察することで、科学者たちは、単一の試行の即時的な結果と、動物が選択を行うために用いる広範な戦略とを結びつける、精密な内部回路を発見しました。彼らは、含まれるタンパク質によって区別される2つの特定のタイプの抑制細胞が、同じ出来事に対して正反対の反応を示すことを発見しました。ソマトスタチンと呼ばれるタンパク質を含む一方のタイプは、試行が失敗したときや報酬が予期せず得られたときに活性化します。もう一方の、チロシン水酸化物を含むタイプはそれとは逆で、試行が失敗すると活動が静まり、報酬を受け取ると活発になります。
研究者たちは次に、これら2つの細胞タイプが互いに、また主要なメッセンジャー細胞に対してどのように対話しているかをマッピングしました。彼らは、チロシン水酸化物細胞が活性化しているとき、ソマトスタチン細胞を抑制することを発見しました。この抑制はブレーキを取り除き、主要なメッセンジャー細胞がより自由に発火することを可能にします。この一連のイベントは、良い結果が行動を駆動する細胞の活動を高める特定のシーケンスを誘発する経路を作り出します。この回路が実際に学習に必要であるかどうかをテストするために、科学者たちは生体内の動物においてこれらの細胞を一時的に沈黙させました。ソマトスタチン細胞の働きを止めると、動物は繰り返し間違った選択をするようになり、もはや報われなくなったとしても不適切な戦略に固執しました。逆に、チロシン水酸化物細胞を沈静化させると、動物は正の報酬から学習することが困難になり、正しい行動を強化することに失敗しました。これらの実験は、この特定のマイクロ回路がゲートとして機能し、単一の試行の結果に基づいて脳が行動を更新すべきかどうかを決定していることを示しました。
また、この研究では、これらの行動変化が起こった後に細胞内部で何が起きているのかについても調査しました。ソマトスタチン細胞が抑制されたとき、研究者たちは、興奮性入力と主要なメッセンジャー細胞との間の結合が時間の経過とともに強くなっていることを観察しました。この強化は、実験が終わった後も動物がなぜ同じ間違いを繰り返し続けたのかを説明し得る、脳の配線の物理的な変化を示唆しています。これらの知見は、この脱抑制回路が単に単一の出来事に反応するだけでなく、試行の即時的な結果を永続的な方針の変化へと変容させていることを示しています。この特定の局所的なループを通じて強化のフローをゲートすることによって、脳は適応的な選択を安定させることができ、私たちが成功と失敗から学び、将来の行動を導く方法を確実にすることができるのです。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。