5分程度で“見える”レベルの3D生成
とはいえ、競合他社が目標としていると思われるため、Tencent HY 3Dを調べて、現状の最先端の3D生成の実情を探るべく試してみました。画像から人型のキャラクターを作り、それをアバター方式のVRM形式で扱い、自由にポーズが取り、それを応用するところまでを紹介してみたいと思います。
以前に比べて、3D生成を成功させるコツもはっきりしてきています。Google Deepmindの画像生成AIモデル「Nano Banana」によって「3Dっぽい画像」を作り、リファレンス画像として使う方法です。3D AIは、元々は3Dモデルで学習しているために、リファレンス画像に立体感などの情報が含まれている方が、正確にその形を再現しやすいようです。
たとえば、SF的なキャラクターモデルを作るとします。素材をまずMidjourneyで作成しますが、2Dのアニメ風のままだと、3D生成があまりうまく行きません。特に、顔が板状に解釈されることが多く、失敗する可能性が高まります。
そこで、Nano Banana Proを使って、3Dグラフィックス風の見た目にします。手と身体がモデルとしてくっついたりしないように、3Dモデルの一般的なポーズの「Tポーズ」姿勢になるように指定します。そうすることで、より生成しやすいデザインになります。最低限、前と後ろの二面図があれば、3Dにすることができます。
<プロンプト>
画像1を、3Dグラフィックス風の画像の前と後ろの二面図のTポーズにして。3DCG、リアルタイムレンダリング、実写風。背景は白のシンプルなものに。
Tencent HY 3Dの設定は、生成するポリゴン数を50万(500k)以下に指定して生成します。これは後に、自動でボーン(骨)を入れることができる「Adobe Mixamo」を使うためです。Mixamoは処理できるデータ量に限界があるようで、筆者が試した限り50万ポリゴン以下である必要がありました。
5分ほど待って生み出された生成結果は、それなりの水準で出てきます。ディテールが潰れているなどの問題はありますが、以前に比べるとだいぶ「見える」レベルになってきました。PBR(物理ベースのレンダリング)テクスチャも生成してくれるため、表面のライティングもきちんと反映されています。
本記事はアフィリエイトプログラムによる収益を得ている場合があります

この連載の記事
-
第171回
AI
5秒の動画を3秒で出せる 動画生成AI「MiniMax H3」が爆速に進化 -
第170回
AI
「うわ、すげえ!」Unreal EngineをCodexに操作させたら制作の常識が変わった -
第169回
AI
もはやローカル動画生成AIの枠におさまらない。MiniMax H3の奥が深すぎる -
第168回
AI
とんでもない動画生成AIが出てきた 無料で試し放題の「MiniMax H3」を徹底検証 -
第167回
AI
“Fable級が無料”は本当か AI市場を震撼させた「Kimi K3」を試した結果 -
第166回
AI
社内WebサービスをAIで開発 完成後に直面した運用の壁 -
第165回
AI
AIがBlenderを勝手に操作 3D制作のハードルが一気に下がった -
第164回
AI
AIはすでに、私たちの心を内部で再現しているのかもしれない -
第163回
AI
無料の画像生成AI「Krea 2」が話題 実写もアニメもこなす新勢力 -
第162回
AI
ローカルAIで“しゃべる推理ゲーム”を作ったら、思ったよりちゃんとゲームになってきた -
第161回
AI
わずか3日で停止された新AI「Claude Fable 5」は何がすごかったのか - この連載の一覧へ







