ミュージックビデオが非常にパワフル
最後に、声との組み合わせの強力さもご紹介します。記事冒頭で使ったのは公式公開されているテンプレート「LTX-2.3画像 オーディオからビデオへ」です。リップシンクが日本語でもかなり正確に追従し、歌唱曲で生成した場合にも、非常にパワフルに描写されます。
音楽AI「Suno」で作成した曲を使った作例は1分半の動画ですが、45秒+30秒+30秒で分けて生成し、最後に「Adobe Premiere Pro」で結合しています。アップテンポの曲に合わせてしっかりとリップシンクが追従しています。何度か試してみた様子では30秒~45秒あたりに限界があるようで、それを超えると画質が急激に低下し始めます。そのため、曲全体に適応するには分割して生成することが必要でしょう。
△田中さんが教室で歌っている設定での動画
ただ、若干の注意点があります。公式ワークフローに若干手を加えたほうがいいという点です。(1)T2Vの時とは逆にテキストはシンプルな方がよく追従しやすと思われること(a cute Japanese girl with a dark bob hair and glasses singing passionately with empty hands)、(2)Prompt Enhancementのノードの3つはプロンプトを勝手に変えてしまうため、バイパスしたほうが良い結果になりやすいこと、(3)VAEデコードのtemporal_sizeは768ではなく512に落としたほうが動いてくれること、がコミュニティで共有されています。
本記事はアフィリエイトプログラムによる収益を得ている場合があります

この連載の記事
-
第149回
AI
AIと8回話しただけで“性格が変わる” 研究が警告する「おべっかAI」の影響 -
第148回
AI
AIが15万字の小説を1週間で執筆──「Claude Opus 4.6」が示した創作の未来 -
第147回
AI
ゲーム開発開始から3年、AIは“必須”になった──Steam新作「Exelio」の舞台裏 -
第146回
AI
ローカル音楽生成AIの新定番? ACE-Step 1.5はSuno連携で化ける -
第145回
AI
ComfyUI、画像生成AI「Anima」共同開発 アニメ系モデルで“SDXL超え”狙う -
第144回
AI
わずか4秒の音声からクローン完成 音声生成AIの実力が想像以上だった -
第143回
AI
AIエージェントが書いた“異世界転生”、人間が書いた小説と見分けるのが難しいレベルに -
第142回
AI
数枚の画像とAI動画で“VTuber”ができる!? 「MotionPNG Tuber」という新発想 -
第141回
AI
AIエージェントにお金を払えば、誰でもゲームを作れてしまうという衝撃の事実 開発者の仕事はどうなる? -
第140回
AI
3Dモデル生成AIのレベルが上がった 画像→3Dキャラ→動画化が現実的に - この連載の一覧へ











