QuantFormer: Learning to Quantize for Neural Activity Forecasting in Mouse Visual Cortex
本論文は、動的な信号量子化とニューロン固有のトークンを通じて神経活動予測を分類問題へと再定義する、新しいTransformerベースのモデルであるQuantFormerを導入し、二光子カルシウムイメージングデータからマウスの視覚野ダイナミクスを予測することにおいて最先端の性能を達成している。
原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは査読を受けていないプレプリントのAI生成解説です。医学的助言ではありません。この内容に基づいて健康上の判断をしないでください。 免責事項の全文を読む
脳は、思考、運動、感覚を生み出すために、それぞれが複雑なリズムで発火する数十億の細胞からなる、広大でハミングするようなネットワークです。この仕組みがどのように機能しているかを理解するために、科学者たちはしばしば、特殊な顕微鏡を用いて細胞が化学信号で光る瞬間を観察し、これらの細胞がどのように活動しているかを見守ります。この活動は一定ではなく、ほとんどの明かりが消えているものの、何かに興味深いことが起きた瞬間に特定の窓が点滅する都市のように、突然かつ疎らなバーストとして現れます。数十年にわたり、研究者たちはこれらの「閃光」を予測できるコンピュータモデルを構築しようと試みてきました。いつか脳が次に何をしようとしているのかを予見することを期待してのことです。これは困難な作業です。なぜなら、信号は乱雑で、パターンは束の間であり、関与する細胞の膨大な数がデータを圧倒的なものにするからです。もし科学者がこれらの神経の火花を確実に予測できれば、実験をリアルタイムで調整できるようになり、おそらく機能の回復や行動への理解を深めることに役立つでしょう。
研究チームは現在、この問題に対して新しいアプローチを導入し、「QuantFormer」と呼ばれるシステムを作り上げました。信号のあらゆる瞬間における正確な明るさを予測しようとするのではなく(それは、部屋の正確な温度を毎秒予測しようとするようなものです)、チームは問題を異なる形で捉えることにしました。彼らは、神経活動は非常に疎らであるため、細胞の輝きの正確な度合いを測定しようとするよりも、細胞が活動しているか否かについて考える方がより有用であると気づいたのです。これを行うために、彼らは連続的で流れるような神経データを通時的な一連の明確で離散的なステップへと翻訳することを学習するコンピュータモデルを構築しました。滑らかに流れる川を取り上げ、そこに一連の「踏み石」を置くことを想像してください。モデルは一つの石から次の石へと飛び移ることを学習し、流動的な信号の予測を、正しい石を選ぶというゲームへと効果的に変容させます。この転換により、コンピュータは背景の静かなノイズの中で迷うことなく、最も重要な瞬間、すなわち実際の活動の閃光に焦点を当てることができるようになります。
研究者たちは、マウスの視覚野からの膨大なデータのコレクションを用いて、このモデルを訓練しました。視覚野は、動物が見ているものを処理する脳の領域です。彼らはマウスに、動く縞模様から自然な風景まで、さまざまな画像を見せ、数千個の個々のニューロンがどのように反応したかを記録しました。モデルにはまず、これらの記録の欠落している部分を埋めるように教えられ、そのプロセスによって、ニューロンが時間の経過とともにどのように振る舞うかという根本的なルールを学習させました。決定的なことに、このシステムは一度に任意の数のニューロンを扱うように設計されています。各ニューロンに固有のデジタル名札を与えることで、モデルは、観察されている細胞の数がどれほどであっても、そのグループ内のすべての細胞の特定の習慣を学習することができました。この柔軟性は大きな前進です。なぜなら、従来の手法は、細胞の数が変化したり、多くの細胞を同時に分析しようとしたりすると、苦戦することが多かったからです。
テストにおいて、この新しいモデルは、ニューロンが視覚刺激にどのように反応するかを予測する上で、驚くほど効果的であることが証明されました。既存の手法よりも、ニューロンの反応のタイミングと形状、特に脳が情報を処理する方法を定義する鋭く突然の活動のバーストを捉えることに優れていました。モデルは、単に平均的な振る舞いを記憶しているのではなく、神経回路の真のダイナミクスを学習したことを示唆するレベルの精度で、これらのパターンを予測することができました。研究者たちはまた、モデルが優れた汎用性を持つこと、つまり、初期訓練時に見ていない異なるマウスや異なる種類の画像に対しても効果的に機能することを発見しました。これは、システムが、異なる個体や状況に適用される神経活動の基礎的な言語を学習したことを示唆しています。
しかし、著者らは自分たちのモデルができることとできないことについて注意深く述べています。このモデルはニューロンの化学的な輝きを予測することには長けていますが、その輝きを引き起こす電気的なスパイクを直接予測するわけではありません。両者の関係は複雑であり、現在のところ、このモデルは基礎となる電気的なイベントよりも、目に見える蛍光信号を予測するためのツールとして理解するのが最適です。こうした限界はあるものの、この研究は神経科学のための基礎的なツールを作成するための重要な飛躍を意味しています。困難な予測問題を、より管理しやすい分類タスクへと再構成することに成功したことで、研究者たちは、いつか科学者がリアルタイムで脳と相互作用することを助けるシステムの道を切り開き、精神がいかに機能するか、そしてそれがうまくいかないときにどのように助けられるかについての理解に新たな扉を開いたのです。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。