画像生成AI「StableDiffusion」の進化が止まりません。昨年8月にオープンソースとしてリリースされてから、世界中のプロアマ問わず多数の人たちが様々な研究成果を反映させ、毎日と言っていいほど新機能を誰かが発表するという状況が起きています。
StableDiffusion登場当初は、画像の品質のランダム性が高く、構図やポーズなどを指定できないという弱点を抱えていました。1枚の画像をもとに画像を生成する「i2i(image2image)」である程度コントロールすることはできても、「キャラクターに特定のポーズをとらせる」といったことは非常に難しかったんですね。
その状況を一変させる新機能が今年2月に登場しました。その名も「ControlNet」。プロンプトによる制約を克服するための、とてつもないポテンシャルを持つ技術でした。Stable Diffusionに次ぐ「2度目の炸裂」と言っていいほど、生成AIのあり方を変えてしまいました。
ControlNetを発表したのは、ハンドルネームlllyasviel、チャン・リュミンさんという研究者です。2月に関連論文を発表した後、2週間程度でStable Diffusionの制作環境「A1111 Web UI」の拡張機能に組み込まれてきたので、世界中が驚きました。論文発表後、これだけの早さで機能が実装されるというのは非常に珍しいことです。特に企業の場合、チェックプロセスなど様々な工程があるため、発表から1年程度待たされるのは当たり前のことでした。
ControlNetの開発者のチャン・リュミンさん(チャンさんの公式ページより)
チャンさんはもともと香港中文大学で、白黒のイラストに着彩するAI技術「Style2Paints」を研究されていた方です。この研究は日本でもずいぶんと話題になりました。現在は、2022年にシリコンバレーの中心地にある米スタンフォード大学の博士課程に進み、画像生成AIの研究室に所属しているようです。
本記事はアフィリエイトプログラムによる収益を得ている場合があります

この連載の記事
-
第176回
AI
無料ツールとAIでMV制作が激変 After Effectsまで自動操作できた -
第175回
AI
AIが人間のようにゲームをプレイ 話題の「Jev」を試してわかったこと -
第174回
AI
AIでMVを作るのは想像以上に大変だった 制作34時間、繰り返した“ダメ出し”でわかったこと -
第173回
AI
OpenAI「Astra」は何でもできる、だからこそ“プロの指示”が必要になる -
第172回
AI
ついにAIキャラクターと“ビデオチャット”へ 「MiniMax H3」がリアルタイム生成に接近 -
第171回
AI
5秒の動画を3秒で出せる 動画生成AI「MiniMax H3」が爆速に進化 -
第170回
AI
「うわ、すげえ!」Unreal EngineをCodexに操作させたら制作の常識が変わった -
第169回
AI
もはやローカル動画生成AIの枠におさまらない。MiniMax H3の奥が深すぎる -
第168回
AI
とんでもない動画生成AIが出てきた 無料で試し放題の「MiniMax H3」を徹底検証 -
第167回
AI
“Fable級が無料”は本当か AI市場を震撼させた「Kimi K3」を試した結果 -
第166回
AI
社内WebサービスをAIで開発 完成後に直面した運用の壁 - この連載の一覧へ







