ローカル動画生成AIは「Wan 2.2」が決定打に
4月には、画像生成AIサービスの定番「Midjourney」が動画に対応。実写系のみならず、アニメ系の描写でも品質が高く、画像生成のシステムと統合されており、操作が簡単なことで話題になりました。また価格設定も安価であったことが評価を集める要因となりました。ただ、その後に大きなアップデートをかけているわけではないため、最近ではやや微妙に感じられるようになっています。(参考:Midjourneyの動画生成AIが強い 驚きの高性能で価格破壊)
△Midjourney Videoでの明日来子さんの動画
同じ4月に、天才的なAIツール開発者のIllyasviel氏が投入し、革命的だと話題になったのが「Framepack」。Hunyuan Videoを拡張して、VRAMわずか6GBのGPUでも動かせる動画生成AI技術ということで大きく注目されました。最終フレームから推定して、全体の動画を推定することで、ローカルPC上でも30秒といった長い動画の生成も可能にするという画期的な技術でした。Framepackの方法論自体はそこまでは定着しませんでしたが、ここで“一貫性”が大きく注目され、動画生成AIの技術をいかに使って、人物などの一貫性を出すかという研究がユーザー間でも進んでいくきっかけとなりました(参考:“イリヤ神”がまたやった 動画生成AI「FramePack」が革命的なワケ)。
△Framepackで生成した30秒動画
その後、動画生成AIが大きく動いたのは7月です。アリババがリリースした「Wan 2.2」のインパクトはとても大きく、いまだにローカル上では最強クラスです。今年、画像・動画AIではオープンモデルを公開する動きでは、中国企業が席巻しています。特に、積極的に展開しているのが、アリババで、2月にリリースした「Wan 2.1」でも高い評価を得ていたのですが、Wan 2.2はさらに性能向上がなされていました。(参考:無料の動画生成AI「Wan2.2」が凄すぎる PCローカルでこの品質が出せるとは)
さらに、ControlNetに対応してダンスアニメーションを実現する「Wan 2.2 Fun Control」、音声のリップシンクを実現する「Wan2.2 S2V」など様々な派生モデルが登場しています。(参考:動画生成AI「Wan2.2」の進化が凄い アリババが無料AIモデルの牽引者に)
△Wan 2.2で生成した明日来子さんの銃の動画
△Wan 2.2 Fun Controlで生成したダンス動画

この連載の記事
-
第146回
AI
ローカル音楽生成AIの新定番? ACE-Step 1.5はSuno連携で化ける -
第145回
AI
ComfyUI、画像生成AI「Anima」共同開発 アニメ系モデルで“SDXL超え”狙う -
第144回
AI
わずか4秒の音声からクローン完成 音声生成AIの実力が想像以上だった -
第143回
AI
AIエージェントが書いた“異世界転生”、人間が書いた小説と見分けるのが難しいレベルに -
第142回
AI
数枚の画像とAI動画で“VTuber”ができる!? 「MotionPNG Tuber」という新発想 -
第141回
AI
AIエージェントにお金を払えば、誰でもゲームを作れてしまうという衝撃の事実 開発者の仕事はどうなる? -
第140回
AI
3Dモデル生成AIのレベルが上がった 画像→3Dキャラ→動画化が現実的に -
第139回
AI
AIフェイクはここまで来た 自分の顔で試して分かった“違和感”と恐怖 -
第138回
AI
数百万人が使う“AI彼女”アプリ「SillyTavern」が面白い -
第137回
AI
画像生成AI「Nano Banana Pro」で判明した“ストーリーボード革命” - この連載の一覧へ









