今回のテーマは、2025年の画像・動画生成AIまとめです。2022年に誰でも利用可能な形で登場した画像AI、動画AIは、ついに長年の課題だった“一貫性の壁”を突破しました。シーンや状況を変えても、登場人物の顔や服装に連続性を保ったまま、表現を変えたり、別の服装にしたり、角度を変えたりといったことが容易にできるようになってきました。8月に発表されたグーグルの「Nano Banana」、それをさらに上回る性能の11月の「Nano Banana Pro」が最大級の驚きでした。画像AIではバイトダンス「Seedream」、アリババ「Qwen-Image-Edit-2509」などが、動画AIではOpenAI「Sora2」やxAI「Grok Imagine」、「Kling」、「Wan」などで、一貫性をテーマにAI各社が激しく競争を続けた1年間でした。
※記事配信先の設定によっては図版や動画等が正しく表示されないことがあります。その場合はASCII.jpをご覧ください
ローカル、クラウドともに動画生成AIが発展
動画生成AIについては1年前の2024年12月、テンセント「Hunyuan Video」がリリースされたことで「使い物になるかもしれない」という雰囲気が出てきました。今では若干微妙な品質に見えてしまいますが、当時はこれでもローカル環境で動かせるモデルとしては、人体の破綻が少ないものでした。ローカルモデルらしく、追加学習(LoRA)でアダルト動画が大量に作られるようになったことも注目を集めることになりました。(参考:動画生成AI、ついにアダルトの扉が開く)
△Hunyuan Videoで生成した水着の女性の動画
その後、2025年3月にグーグル「Veo 2」、さらに6月には「Veo 3」が発表されて、その水準に驚かされました。2024年12月にリリースされたOpenAIの「Sora」の品質が期待外れであったこともあり、評価を集めました。ラーメンを食べるといった表現は、人物と対象物とが複雑に重なり合うような構図でさえも、自然に生成できるようになりました。ただし、当初は柔軟性が低かったことと、値段の高さがネックになりました。
また、同時期に注目されていたのが「KlingAI」で、現在でも、クラウド系動画AIサービスを引っ張る中心的な存在の一つです。(参考:動画生成AIの進化がすごい 「超リアル」「ローカルで動く」2つの方向に、グーグルの動画生成AI「Veo 3」が圧倒的、だけど高すぎ)
△Veo 2、Sora、Kling 1.6を比較した動画
△Veo 3で生成したラーメンを食べる日本人女性の動画
本記事はアフィリエイトプログラムによる収益を得ている場合があります

この連載の記事
-
第171回
AI
5秒の動画を3秒で出せる 動画生成AI「MiniMax H3」が爆速に進化 -
第170回
AI
「うわ、すげえ!」Unreal EngineをCodexに操作させたら制作の常識が変わった -
第169回
AI
もはやローカル動画生成AIの枠におさまらない。MiniMax H3の奥が深すぎる -
第168回
AI
とんでもない動画生成AIが出てきた 無料で試し放題の「MiniMax H3」を徹底検証 -
第167回
AI
“Fable級が無料”は本当か AI市場を震撼させた「Kimi K3」を試した結果 -
第166回
AI
社内WebサービスをAIで開発 完成後に直面した運用の壁 -
第165回
AI
AIがBlenderを勝手に操作 3D制作のハードルが一気に下がった -
第164回
AI
AIはすでに、私たちの心を内部で再現しているのかもしれない -
第163回
AI
無料の画像生成AI「Krea 2」が話題 実写もアニメもこなす新勢力 -
第162回
AI
ローカルAIで“しゃべる推理ゲーム”を作ったら、思ったよりちゃんとゲームになってきた -
第161回
AI
わずか3日で停止された新AI「Claude Fable 5」は何がすごかったのか - この連載の一覧へ









