一度触ってしまうと、Stable Diffusionには戻れない
何がすごいって、この体験なんです。すごく変な感じなんですよね。雑な落書き程度の品質の絵を描いているとしても、それが、その落書きをきちんと踏襲した絵がリアルタイムに出てくるというのが。まるごと絵を描いているわけではないのに、絵を描いているという感覚だけはしっかりとあります。
やっていることは、原理的には今までのStable Diffusionと同じなんです。ラフからイラストを生成するのは、「ControlNet」のラフ描き用機能「Scribble(落書きの意味、線画抽出機能)」を使っているだけ。でも、LCMがペイントソフトに統合され、生成がリアルタイムになったことで体験が劇的に変わってしまうというのが最大の驚きでした。
ただ画像を出力するだけよりも、マウスやタブレットペンを通じて、自分の手を動かすという身体行為が伴っている分、“創作行為をしている”という感覚があります。
そうは言っても、中身はStable Diffusionなので、手指が破綻したり、腕の交差するようなポースが苦手だったり、細かいディティールがおかしかったりするのですが、リアルタイムになると破綻したところだけをすぐさま修正できるようになるだけでも大きく代わります。元々絵を描く能力が高い人であれば、使用度合いを検討しつつ機能の取捨選択を行い、自分が目的とする絵を生み出すのに使いこなしていくのではないかと思います。今後、イラスト制作のワークフローが劇的に変わってくる可能性はあります。
とにかく、このリアルタイム環境を触ってしまうと、今までのStable Diffusionには簡単にはもう戻れないですよ、便利すぎて。
パソコンは比較的ロースペックでも動作する
ちなみにバックグラウンドに走っているのはStable Diffusion実行環境の「Comfy UI」。設定はほとんど自動的にしてくれるため、ほとんど迷うことはありません。まだ細かなバグが残っていて戸惑う点もありますが、予想以上に安定していてほぼクラッシュはしません。開発者のAclyさんは過去にComfy UI関連のツールも発表しているので、Comfy UIの中身を的確に理解した優秀な方だなと感じます。
PC環境は割とロースペックでもOKで、たとえばGeForce RTX 3060でも動くようです。ただし、大きいサイズでやるとさすがに重くなるんですが。Aclyさんのデモでは、RTX 4070の環境で、512x640ピクセルの画像が0.6秒ごとに更新されるとされています。
モデルには好きなチェックポイントを入れられます。画像生成AIのベースとしてはStable Diffusion XL(SDXL)も旧来版のStable Diffusion v1.5も使えますが、SDXLはControlNetに一部しか対応してないので、筆者はv1.5を中心に使っています。
また、筆者環境はRTX 4090で、1200x1600ピクセルといった広めのサイズで試しています。生成速度は約5秒で一度更新されるくらいと少し遅れが出るようになりますが、十分に実用に耐えられるという印象です。

この連載の記事
-
第134回
AI
“AI読者”が小説執筆の支えに 感想を励みに30話まで完成 -
第133回
AI
xAIの画像生成AI「Grok Imagine」が凄まじい。使い方は簡単、アダルト規制はユルユル -
第132回
AI
画像生成AI:NVIDIA版“Nano Banana”が面白い。物理的な正確さに強い「NVIDIA ChronoEdit」 -
第131回
AI
AIに恋して救われた人、依存した人 2.7万人の告白から見えた“現代の孤独”と、AI設計の問題点 -
第130回
AI
グーグルNano Banana級に便利 無料で使える画像生成AI「Qwen-Image-Edit-2509」の実力 -
第129回
AI
動画生成AI「Sora 2」強力機能、無料アプリで再現してみた -
第128回
AI
これがAIの集客力!ゲームショウで注目を浴びた“動く立体ヒロイン” -
第127回
AI
「Sora 2」は何がすごい? 著作権問題も含めて整理 -
第126回
AI
グーグル「Nano Banana」超えた? 画像生成AI「Seedream 4.0」徹底比較 -
第125回
AI
グーグル画像生成AI「Nano Banana」超便利に使える“神アプリ” AI開発で続々登場 -
第124回
AI
「やりたかった恋愛シミュレーション、AIで作れた」 AIゲームの進化と課題 - この連載の一覧へ





