最大9枚の画像を参照できる「Omni Reference」が強力
Omni Referenceの強力さはすぐにわかります。この連載でKrea2について紹介した作例を、動画化してみました。オウムたちが羽を広げてじゃれてみたり、駅の少女が構内に入ってくる鉄道を見て走り出したりといった、それぞれ画像1枚しか参照させていないにも関わらず、イラストの画風や人物、背景の一貫性を維持しながら、その変化を破綻なく描いています(参考:無料の画像生成AI「Krea 2」が話題 実写もアニメもこなす新勢力)。
△オウムと少女の動画。驚いたのが羽を羽ばたいても破綻が見られなかったところ
△駅にいる少女の動画。セリフを指定していなかったので謎言語を話している
参照できる画像の画風はかなり幅広いです。この連載のモデル役の明日来子さんを使って、いつも使っている作例画像を動画化してみました。1つ目の動画は商店街を紹介し、最後に日本語のセリフを言わせています。2つ目の動画では銃を構えて発砲後、後方で爆発が起きるとしました。どちらも同じ1枚の画像を参照させ、プロンプトで指示しています。顔の角度が変わったりしていても、一貫性が守られている点、爆発などが非常に美しく生成されている点、SEや音楽が自動でついている点など、見るべき点が多数あります。
昨年8月に、アリババの動画AI「Wan2.2」で同じようなことを試していますが、品質が明らかに向上しています(参考:無料の動画生成AI「Wan2.2」が凄すぎる PCローカルでこの品質が出せるとは)。
△明日来子さんが、商店街を紹介している様子
△銃を構えて発砲後に背景で爆発が起きている動画
もちろん、OpenAIの「GPT Image 2」で生成した画像でも可能です。過去にこの連載で作成した画像をそれぞれ4枚を参照させて、動画を作成してみます。最初は、明日来子さんが、4種類の服装を次々と切り替えていくシーン。もう一つは、フェイク画像として筆者と明日来子さんの仮想デートシーンを使って作成したものです。それぞれのシーンが、説得力を保ちながら一貫して生成されています。(参考:ChatGPTの画像生成AIが強すぎる AI画像が世界中に氾濫する時代へ/ChatGPTの画像生成AIは本当に最強か Nano Bananaと比べて見えた“弱点”)
△明日来子さんが、服を次々に切り替えながら、歩いているシーンの動画
△明日来子さんとフェイク筆者とがデートをしているシーン
広告映像から360度動画まで 応用の幅も広い
さらには広告風の映像から360度動画といったものの生成も可能です。
「アスキースパーク」というジュースの宣伝をGPT-Image2で以前につくった画像を、CM風にと指示して作成したものが次です。海の中に入り込むなど、冗談のような動画になっていますが、プロンプトを細かく指示していくと、かなり複雑な作り込みもできそうです。
また、千手観音像の前・左右・後ろの4枚から作成させてみました。3Dモデルデータとして扱える「3Dガウシアン・スプラィング」といったデータの作成にも使える品質と言えるかもしれません。
△アスキースパークのジュースCM動画
△千手観音像の360度動画
本記事はアフィリエイトプログラムによる収益を得ている場合があります

この連載の記事
-
第167回
AI
“Fable級が無料”は本当か AI市場を震撼させた「Kimi K3」を試した結果 -
第166回
AI
社内WebサービスをAIで開発 完成後に直面した運用の壁 -
第165回
AI
AIがBlenderを勝手に操作 3D制作のハードルが一気に下がった -
第164回
AI
AIはすでに、私たちの心を内部で再現しているのかもしれない -
第163回
AI
無料の画像生成AI「Krea 2」が話題 実写もアニメもこなす新勢力 -
第162回
AI
ローカルAIで“しゃべる推理ゲーム”を作ったら、思ったよりちゃんとゲームになってきた -
第161回
AI
わずか3日で停止された新AI「Claude Fable 5」は何がすごかったのか -
第160回
AI
寝不足になるほど面白い ローカルAIと音声合成をつないだら、キャラが普通にしゃべり始めた -
第159回
AI
AIを使える人と使えない人で、とんでもない差が出ると実感した理由 -
第158回
AI
SDXLの次はこれ? アニメ特化のローカル画像生成AI、驚きの実力 - この連載の一覧へ









