5月15日にComfyUIが共同開発している画像生成AIモデル「Anima Base v1.0」が公開されました。2B(20億)パラメータで、本体モデルのファイルサイズも4.18GBと比較的小さいモデルですが、ローカルPC環境で動作するアニメスタイル専用モデルとして、高性能に仕上がっています。その強力さは、追加学習用のLoRAを作成すると、さらに明確に分かります。これまで、GPT Image 2.0などのクラウドモデルでは実現できていましたが、ローカルPCで使えるオープンモデルでは、複雑なキャラクターの一貫性を保つのが難しい状況でした。その限界を突破する存在になりそうです。
ComfyUI共同開発のアニメ系モデル「Anima」
Animaは、ComfyUIから資金提供を受けている米Circle Stone Labが、1月からプレビュー版の公開を開始し、毎月のようにアップデートを重ねてきました(参考:ComfyUI、画像生成AI「Anima」共同開発 アニメ系モデルで“SDXL超え”狙う)。Anima Base v1.0は、ベースとなる完成版モデルで、学習が進んだことで、Preview版にあったノイズ感はほとんど解消されており、クリアな画質で出力できます。モデルサイズは4.18GBと大型化が進む近年のモデルの中では小さく、ビデオカードのVRAMが8GBでも動作します。しかし、解像度は一般的な1024x1024よりかなり大きい1536x1536までサポートしています。筆者のA6000搭載(RTX 3090に相当)では、1024x1024の画像を1枚生成するのに、約30秒かかります。
Animaでクリアかつ品質が高い画像が出せるのはいいのですが、弱点もあります。生成するたびに、画風が大きく揺れるのです。同じプロンプトであっても、キャラクターの雰囲気はかなり変わってしまいます。プロンプトだけで制御するのは難しいようです。そこで効果を発揮するのがLoRAです。Animaの画像の揺れを抑制し、自分の意図する画像へコントロールしやすくなるのです。 Anima用のLoRA作成環境は、日本人技術者のKohya Tech(@kohya_tech)さんが継続的に開発を続けている世界的なデファクトスタンダードの一つである「sd-scripts」が、2月にAnimaをサポートしました。それをgazingstarsさんがGUI化し、使いやすくした「Anima Standalone Trainer」として公開しました。
本記事はアフィリエイトプログラムによる収益を得ている場合があります

この連載の記事
-
第167回
AI
“Fable級が無料”は本当か AI市場を震撼させた「Kimi K3」を試した結果 -
第166回
AI
社内WebサービスをAIで開発 完成後に直面した運用の壁 -
第165回
AI
AIがBlenderを勝手に操作 3D制作のハードルが一気に下がった -
第164回
AI
AIはすでに、私たちの心を内部で再現しているのかもしれない -
第163回
AI
無料の画像生成AI「Krea 2」が話題 実写もアニメもこなす新勢力 -
第162回
AI
ローカルAIで“しゃべる推理ゲーム”を作ったら、思ったよりちゃんとゲームになってきた -
第161回
AI
わずか3日で停止された新AI「Claude Fable 5」は何がすごかったのか -
第160回
AI
寝不足になるほど面白い ローカルAIと音声合成をつないだら、キャラが普通にしゃべり始めた -
第159回
AI
AIを使える人と使えない人で、とんでもない差が出ると実感した理由 -
第157回
AI
AIだけでゲームは作れるのか? Codexに7本作らせて見えた実力と限界 - この連載の一覧へ







