画像生成AI「StableDiffusion」の進化が止まりません。昨年8月にオープンソースとしてリリースされてから、世界中のプロアマ問わず多数の人たちが様々な研究成果を反映させ、毎日と言っていいほど新機能を誰かが発表するという状況が起きています。
StableDiffusion登場当初は、画像の品質のランダム性が高く、構図やポーズなどを指定できないという弱点を抱えていました。1枚の画像をもとに画像を生成する「i2i(image2image)」である程度コントロールすることはできても、「キャラクターに特定のポーズをとらせる」といったことは非常に難しかったんですね。
その状況を一変させる新機能が今年2月に登場しました。その名も「ControlNet」。プロンプトによる制約を克服するための、とてつもないポテンシャルを持つ技術でした。Stable Diffusionに次ぐ「2度目の炸裂」と言っていいほど、生成AIのあり方を変えてしまいました。
ControlNetを発表したのは、ハンドルネームlllyasviel、チャン・リュミンさんという研究者です。2月に関連論文を発表した後、2週間程度でStable Diffusionの制作環境「A1111 Web UI」の拡張機能に組み込まれてきたので、世界中が驚きました。論文発表後、これだけの早さで機能が実装されるというのは非常に珍しいことです。特に企業の場合、チェックプロセスなど様々な工程があるため、発表から1年程度待たされるのは当たり前のことでした。

ControlNetの開発者のチャン・リュミンさん(チャンさんの公式ページより)
チャンさんはもともと香港中文大学で、白黒のイラストに着彩するAI技術「Style2Paints」を研究されていた方です。この研究は日本でもずいぶんと話題になりました。現在は、2022年にシリコンバレーの中心地にある米スタンフォード大学の博士課程に進み、画像生成AIの研究室に所属しているようです。

この連載の記事
-
第37回
AI
ゲーム業界、生成AIで激変の兆し 圧倒的王者Steamに挑むEpic Games -
第36回
AI
アニメの常識、画像生成AIが変える可能性「AnimateDiff」のすごい進化 -
第35回
AI
画像生成AIに“表現の自由”を スーパーハッカーが挑んだ「Fooocus」 -
第34回
AI
画像生成AI、3Dホログラムにも革命起こす? -
第33回
AI
“YOASOBI風”の楽曲も 音声生成AIのやっかいな問題 -
第32回
AI
動画生成AIがすごすぎる 映画登場も遠くない -
第31回
AI
収入がAIに減らされる ハリウッドで悲鳴 -
第30回
AI
世界を変えた画像生成AI、さらに進化「Stable Diffusion XL(SDXL)」いよいよ正式公開 -
第29回
トピックス
ゲームの“自動生成”技術がすごいことになっている -
第28回
Apple
アップル「Vision Pro」それはザッカーバーグが作りたくても作れなかったもの -
第27回
AI
集英社も取り下げた「AIグラビア」の問題点 - この連載の一覧へ