Forecasting viral evolution from phylogenetic trees
本論文は、系統樹を活用することで、SARS-CoV-2、インフルエンザ、デング熱を含む複数の病原体にわたり将来のウイルス変異を正確に予測し、それによってパンデミックへの備えと治療法の開発を強化する機械学習モデルであるantiGenを紹介するものである。
原論文は CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは査読を受けていないプレプリントのAI生成解説です。医学的助言ではありません。この内容に基づいて健康上の判断をしないでください。 免責事項の全文を読む
ウイルスは執拗な変幻自在の存在です。宿主の内部で増殖する際、彼らは自身の遺伝コードに微細なコピーミスを引き起こし、自身の新しいバージョンを作り出します。これらの変化のほとんどは何の作用ももたらしませんが、時として、ウイルスの拡散速度を上げたり免疫系を回避したりするような、新たな優位性を与える変異が生じることがあります。この絶え間ない進化こそが、昨年のインフルエンザワクチンが今年あなたを守れない可能性がある理由であり、新型コロナウイルス(COVID-19)のような疾患の新しい変異株が予期せず出現する理由なのです。これらの脅威の先手を打つために、科学者たちは次にどのような変化が起こりそうかを予測する必要があります。従来、研究者たちは、ラボでタンパク質がどのように振る舞うかを研究したり、既存の膨大な遺伝配列ライブラリを解析するコンピュータモデルを使用したりすることで、将来の変異を推測しようとしてきました。しかし、これらの手法は、ウイルスが実際に時間や集団の中をどのように移動していくかという全体像を捉えることに苦慮することがよくあります。
スタンフォード大学とアーク研究所の研究チームは、ウイルスの家族の歴史を見てその未来を予測するという、新しいアプローチを開発しました。彼らは「antiGen」と呼ばれる機械学習モデルを作成しましたが、これはウイルスの現在の遺伝コードを単に学習するのではなく、ウイルスの進化の経路から学習するものです。単に配列を暗記するのではなく、このモデルは、あるバージョンから別のバージョンへとウイルスが移行するために辿った具体的なステップを研究します。それは、まるで歴史家が大きな歴史的転換をもたらした特定の出来事を研究するかのようです。ウイルスの「家系図」(異なる系統がどのように関連し、いつ分岐したかをマッピングした図)を分析することで、モデルはどの変異が次に現れやすいかを支配するルールを学習します。この手法により、システムはまだ一度も目にしたことのない変化を予見することが可能になり、新しい変異株が広がる前にワクチンや治療法を準備するための強力なツールとなります。
研究者たちは、このシステムをまず、COVID-19パンデミックの原因となったSARS-CoV-2ウイルスに対してテストしました。彼らはパンデミックの最初の1年間に収集された数百万もの遺伝配列をモデルに投入し、その後の数年間に現れるであろう変異を予測させました。その結果、モデルは、ウイルスのスパイクタンパク質(ヒトの細胞への侵入を可能にする部分)における次の起こりやすい変化を予測する上で、既存のあらゆる手法よりも優れた性能を示しました。決定的なことに、このモデルはトレーニングデータには一度も観察されていなかった変異の予測にも成功しました。これは、モデルが単に過去の出来事を暗記したのではなく、ウイルスの進化に関する根本的な原理を学習したことを示唆しています。これらの予測が生物学的に現実のものであることを確認するため、チームは予測されたウイルス変異体をラボ内で作成しました。その結果、コンピュータによって生成された変異体の多くが依然として細胞に感染できることが判明し、モデルがランダムなエラーではなく、生存可能な機能的な変化を提案していることが証明されました。
antiGenの成功は、コロナウイルスだけに留まりませんでした。チームはこの同じモデルを、季節性インフルエンザ、呼吸器合胞体ウイルス(RSV)、デング熱ウイルスという他の3つの一般的なウイルスにも適用しました。これらのウイルスについては、SARS-CoV-2と比較して利用可能な遺伝データがはるかに少ないにもかかわらず、モデルは依然として従来の予測手法を上回る精度で将来の変異を予測しました。このことは、このアプローチが、利用可能な監視データの量に関わらず、幅広いウイルスに対して有効であることを示唆しています。研究者たちはまた、収集されるデータが増えるにつれてモデルの精度が向上することも発見しました。これは、ウイルスの進化を追跡し続けるほど、このモデルがより強力なツールになることを意味しています。いくつかのケースでは、モデルの予測を既存の統計的手法と組み合わせることで、データが豊富なシナリオと乏しいシナリオの両方に対応できる、より堅牢な予測システムを作り出すことができました。
このモデルは、どのような変異が起こりやすいかを予測することには非常に高い精度を持っていますが、研究者たちは、これが危険な新しい病原体を作り出すものではないことを強調しています。モデルが予測する変化は、自然な進化プロセスの一部である、小さな一段階の変異です。これらの予測は、公衆衛生当局やワクチン開発者が一歩先を行くために意図されたものです。どのような変異が起こりやすいかを知ることで、科学者は現在循環しているウイルスだけでなく、将来支配的になるであろうバージョンを標的としたワクチンを設計することができます。このプロアクティブ(先行的)なアプローチは、感染症の管理方法を変革し、アウトブレイクに反応するのではなく、それが定着する前に防ぐという方向へとシフトさせる可能性があります。この研究は、ウイルスの遺伝コードに刻まれた歴史に耳を傾けることで、その未来を読み解き始めることができるということを示しています。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。