Directed Evolution in Codon Space
本論文は、タンパク質配列を変更したり製品の品質を損なったりすることなく、同義置換コドン空間内での指向性進化を行うことにより、臨床段階の抗体治療薬の組換え発現を成功裏に向上させる、言語モデルに導かれたフレームワークを提示するものである。
原論文は CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは査読を受けていないプレプリントのAI生成解説です。医学的助言ではありません。この内容に基づいて健康上の判断をしないでください。 免責事項の全文を読む
完璧なパンを焼こうとしているところを想像してみてください。あなたはうまくいくレシピを持っていますが、パン屋さんがこう言います。「このパンをもっと高く膨らませて、もっと美味しくすることはできます。でも、材料のリストを変えることはできません」。これは不可能に聞こえますよね?もし小麦粉を砂糖に入れ替えてしまったら、それは別のケーキになってしまいます。しかし、もしレシピ本の材料そのものは変えずに、その「順番」だけを並べ替えることができたらどうでしょう?これこそが、科学者たちが生物学の世界、特に「タンパク質工学」と呼ばれる分野で仕掛けている魔法のようなトリックなのです。
この物語を理解するために、3つのシンプルな概念が必要です。まず、タンパク質を、病原菌と戦ったり筋肉を作ったりと、体の中でほとんどすべてのことを行う小さな機械だと考えてください。科学者はしばしば、これらのタンパク質を製造するために、特別な細胞(小さな顕微鏡レベルのパン屋さんのようなもの)を使って、薬を作る工場でこれらを作ります。第二に、これらのタンパク質は、生物学的なアルファベットのような「アミノ酸」からなるコードによって組み立てられます。これらの文字の順序が、タンパク質がどのような形になり、どのように機能するかを決定します。第三に、「コドン」と呼ばれる隠れた層があります。自然界には面白いルールがあります。多くの異なる3文字の「単語」(コドン)が、全く同じアミノ酸の文字を綴ることができるのです。それは、まるで「猫」「ねこ」「キャット」という言葉がすべて同じものを意味している辞書のようなものですが、レシピを読み取るコンピューターは特定の単語しか理解できない、といった具合です。通常、科学者は工場にとって最も読みやすいと思う単語を選びますが、この新しい論文はこう問いかけています。「もし、表面上のレシピは同じままで、その単語を入れ替えてみたらどうだろうか?」と。
これこそが、この論文の研究者たちが取り組んだことです。彼らはDNAコードを、物語を変えずに書き換えることができる言語として扱いました。彼らは、すでに製造のために「成熟」または最適化されていると考えられている、抗体(体のための特殊なセキュリティガードのようなもの)に基づいた24種類の異なる薬を取り上げました。これらは下書きではなく、業界がすでに作り上げた最高バージョンのものでした。チームは、自然界がどのように書くかを熟知した高度なスペルチェッカーのような、スマートなコンピュータープログラムを使用し、同じ言葉をより良く綴る方法を探しました。彼らはタンパク質自体は変えませんでした。ただ、同じ意味を持つ異なるコドン(同義コドン)をシャッフルして、工場となる細胞がより多くの薬を生産できるかどうかを調べたのです。
結果は驚くほど良好でした。テストした24種類の薬のうち、コンピューターによる変更によって、18種類(成功率75%)が細胞内でより大量に生産されるようになりました。最も素晴らしい点は、薬の品質が落ちなかったことです。タンパク質は依然として完璧に機能し、見た目も同じでした。ただ、より多くの数で現れるようになっただけなのです。この論文は、配列がすでに「最適化」されている場合であっても、コドンのレベルで詳しく見ていれば、まだ改善の余地が隠されていることを示唆しています。
興味深いことに、コンピューターは自分がより多くのタンパク質を作ろうとしていることさえ知りませんでした。コンピューターは、自然界から学んだパターンに基づいて、どのコドンの組み合わせが最も「自然」か、あるいは起こりやすいかを推測していただけでした。それにもかかわらず、コンピューターが「よりありそうな(尤もらしい)」配列であると言ったとき、その配列は実際に、より多くのタンパク質を生産しました。これは、コンピューターが、人間が設計したエンジニアがまだ解明できていない「効率性の秘密の言語」を偶然学習したことを示唆しています。チームはまた、この「尤もらしさ(likelihood)」のスコアが、インフルエンザウイルスが時間の経過とともにどのように変化するかを追跡していることにも気づきました。これは、モデルがランダムなノイズではなく、実際の進化のシグナルを捉えていることを示唆しています。
では、これは何を意味するのでしょうか?これは、タンパク質の構造自体を微調整するために通常使われる手法である「指向性進化」が、その背後にあるDNAコードを微調整することによっても機能し得ることを示唆しています。この論文は、より良い結果を得るために、必ずしも車輪を再発明したりタンパク質を変えたりする必要はなく、時には、指示書のより良い書き方を見つけるだけでよいのだと主張しています。この研究は、ラボ内のこれらの特定の薬に対して有効であることを示していますが、あらゆる場所でのあらゆる製造問題を解決できると主張しているわけではありません。しかし、これは、私たちの最も重要な薬のDNAの中に、適切なデジタル探偵が見つけ出すのを待っている「アクセス可能な適応度(accessible fitness)」、つまり簡単な勝利がまだ存在していることを示しているのです。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。