Generating 3D models from sketches of human faces using a combined approach of Convolutional Neural Networks, Procedural Modeling, and Contour Mapping
本論文は、表情をアクションユニットを通じて検出するように訓練された畳み込みニューラルネットワーク、それらの表情を適用するためのパラメトリック3Dモデル(Valley Girl)、および生成されたモデルをスケッチの輪郭に整合させるためのアクティブ・スネーク・コンターを組み合わせることで、スケッチから3D顔モデルを生成する新たな手法を提示する。
原論文は CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む
紙の上に描かれた面白い顔の単純な手書きスケッチがあると想像してください。次に、その平面的な描画を、回転させたり、光を当てたり、さらにはアニメーション化したりできる、本物の 3D キャラクターに変えたいと想像してみてください。ナンシー・イスカンダーは、彼女の修士論文でこの問題を解決しました。
彼女の解決策は、コンピュータの知能、デジタルパペットの柔軟性、そして賢い「磁石」システムを組み合わせた、3 工程の組み立てラインのようです。以下に、それを簡単な用語で分解して説明します。
ステップ 1: 「ムード探偵」(畳み込みニューラルネットワーク)
まず、コンピュータは、その描画が何を伝えようとしているかを理解する必要があります。その人は笑っていますか?眉をひそめていますか?目を細めていますか?
- 比喩: これは、粗いスケッチを見るだけで容疑者の気分を推測しようとする探偵のようなものです。
- 仕組み: 著者は、畳み込みニューラルネットワークと呼ばれる AI の一種を使用して、コンピュータに「アクションユニット」(眉を上げたり、鼻をしかめたりすることなど)と呼ばれる特定の筋肉の動きを認識させるように教えました。
- 秘密の武器: 実際の人の写真を使う代わりに、著者は 21,000 以上もの偽の顔とそれに対応するスケッチの巨大なライブラリを作成しました。彼女は「バレイガール」と呼ばれるデジタルパペットを使って、無作為に何千もの異なる顔を作り、それらの写真を撮影し、その後、それらの写真をスケッチに変換しました。この「訓練キャンプ」により、AI は、それが紙の上の線だけであっても、「幸せな顔」と「ニヤニヤした顔」の違いを見分けることを学びました。
ステップ 2: 「デジタルパペット」(手続き的モデリング)
AI が気分(例えば、「このスケッチはニヤニヤした表情を示している」)を知ると、その気分と一致する 3D 顔を構築する必要があります。
- 比喩: すべての筋肉に目に見えない糸が取り付けられたハイテクなマリオネットや粘土模型を想像してください。
- 仕組み: システムは「バレイガール」というデジタルパペットを受け取り、ステップ 1 で AI が検出した内容に基づいて、目に見えない糸を引きます。AI が「ニヤニヤした表情」を検出すれば、パペットの口元は持ち上げられます。「目を細めた」表情を検出すれば、目は小さくなります。
- 結果: これで、正しい表情を持った 3D 顔が手に入りますが、まだ平均的な一般的な人のように見えます。スケッチの中の特定の人物のように見えるには至っていません。
ステップ 3: 「磁気仕立て屋」(アクティブ・スネーク・コンター)
これは、一般的な 3D パペットをスケッチと全く同じように変形させる最終工程です。
- 比喩: 3D パペットの顔の上に、柔軟で磁気的なゴムバンド(「スネーク」)を置くことを想像してください。次に、元のスケッチをその上に置きます。ゴムバンドは、スケッチの暗い線に磁気的に引き寄せられます。それは、描画の線に完璧に吸い付くまで、伸びたり縮んだり、ねじれたりします。
- 仕組み: コンピュータは、スケッチの線に沿って目に見えない「スネーク」を描画します。これらのスネークは、3D モデルの縁に引き寄せられるようにプログラムされています。それらは、モデルの輪郭がスケッチの輪郭と一致するまで、3D モデルの表面を引き寄せます。
- 結果: 3D モデルは、以前に AI が検出した表情を維持しつつ、スケッチの独特な特徴(より広い鼻や特定のあごのラインなど)に一致するように歪められ、形作られます。
最終製品
最終結果は、回転させたり、照明を当てたり、ゲームや映画で使用したりできるリアルな 3D モデルです。著者は、この方法がコンピュータ生成のスケッチと手書きのスケッチの両方で機能することを示しました。
論文が言っていること:
- プロの 3D アーティストがキャラクターデザインを素早くプロトタイピングするのを助ける。
- 複雑なソフトウェアを知らない初心者やインディー開発者が 3D ヘッドを作成できるようにする。
- スケッチアーティストが、自分の描画の正確性を確認するために、3D レンダリングとして描画が生き返るのを見ることを可能にする。
- 子供たちが、自分の単純な描画が 3D キャラクターに変わるのを見ることを可能にする。
論文が認めている、まだできないこと:
- 元の 3D モデルにない新しい特徴を作成することはできない(例えば、3 番目の目を描いても、システムはパペットに 3 番目の目を成長させる方法を知らない)。
- 最初にスケッチをモデルと大まかに揃えるのはユーザーの依存である。もし比率が極端に異なる場合(小さなあごに巨大な口など)、「磁気スネーク」は混乱する可能性がある。
要約すると、この論文は、まず感情を推測し、それに合うパペットを構築し、その後「賢い磁石」を使ってそのパペットを描画に完璧に合うまで引き伸ばすことで、2D の線画を 3D キャラクターに変える巧妙な方法を提示しています。
自分の分野の論文に埋もれていませんか?
研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。