複雑な髪形や服装でもしっかり再現
なぜ、AnimaとSDXLでこれほど差が出るのでしょうか。一つには、SDXLが写真などの汎用環境からスタートし、人気のモデルも、様々なモデルとのマージや追加学習を繰り返しているために、非常に複雑な潜在空間を持つようになっていることが大きいと考えられます。そして、SDXLでは、様々な潜在空間を構成する層に画像を学習させていく必要があるため、効果が出るまでに時間がかかるという特徴があるようです。
それに対して、Animaは「NVIDIA Cosmos」由来のモデルをベースにしており、全体を新しいデータで学習させたモデルで、画像の理解にも「Qwen3」系の新しい技術が採用されています。その上、アニメ特化で余分なものが足されていないため、LoRAの効果がより短い学習で出せるということのようです。言うなれば、余計な学習が足されていない分、「素直」なのです。
次に、もう少し複雑なキャラでも実現可能か試してみましょう。
まず、Animaで、ゲームに登場することを想定したSF風キャラクター(仮称アスレナさん)を1枚生成しました。意識的に、デザインが複雑なものを生成しました。
それを、ローカルPCでも動作するアリババの画像AIモデル「QwenImageEdit-2511」のマルチアングルLoRAを使い、様々な角度やポーズの差分画像を多数作り、品質が高く、一貫性が維持できていると思われる50枚ほどを選びました。筆者は、それらにAnimaに適したタグ付けを行い、データセットを作成しました。
この50枚にキャプションを付け、データセットを作り、様々なシーンを想定して生成した画像が以下です。ステップ数は1000で学習をしています。50枚でも、学習にかかったのは30分程度でした。
特徴的なマント、頭の2本のヘッドセットのアンテナ、前髪とは異なる後ろ髪、水色の剣など、かなり再現できています。肩の紋章や、胸部分のデザインといった、差分データの時点で曖昧だった部分は、その曖昧さがそのまま出てしまっていますが、さらに画像を吟味して品質の高いデータで構成できれば、さらに一貫性のある高品質な画像を出力できると思われます。
本記事はアフィリエイトプログラムによる収益を得ている場合があります

この連載の記事
-
第167回
AI
“Fable級が無料”は本当か AI市場を震撼させた「Kimi K3」を試した結果 -
第166回
AI
社内WebサービスをAIで開発 完成後に直面した運用の壁 -
第165回
AI
AIがBlenderを勝手に操作 3D制作のハードルが一気に下がった -
第164回
AI
AIはすでに、私たちの心を内部で再現しているのかもしれない -
第163回
AI
無料の画像生成AI「Krea 2」が話題 実写もアニメもこなす新勢力 -
第162回
AI
ローカルAIで“しゃべる推理ゲーム”を作ったら、思ったよりちゃんとゲームになってきた -
第161回
AI
わずか3日で停止された新AI「Claude Fable 5」は何がすごかったのか -
第160回
AI
寝不足になるほど面白い ローカルAIと音声合成をつないだら、キャラが普通にしゃべり始めた -
第159回
AI
AIを使える人と使えない人で、とんでもない差が出ると実感した理由 -
第157回
AI
AIだけでゲームは作れるのか? Codexに7本作らせて見えた実力と限界 - この連載の一覧へ








