複雑とシンプル オープンに繰り返されるカウンター
StabilityAIは、SDXLリリース後、展開の再編に入っています。初心者向けツールは「Clipdrop」というクラウド型サービスへと集約化を進め、基本無料の月額課金型サービスへと展開を進めています。
一方、アプリの側は、ComfyUIの開発者のcomfyanonymous氏を雇用し、ComfyUIと同社のStableSwarmUIの統合を進めています。開発環境としては専門知識を要求する複雑な環境へと発展していますが、カスタマイズ性に優れ、複雑なワークフロー設計ができることからエンジニアに強くアピールする内容になっています。同社の環境を基本としたContorlNetに近い機能「Control-LoRAs」を発表するなど、高機能化によって差別化をはかるとともに、これらをClipdropのAPIに統合することで、開発者の支持を得ようとしています。
StabilityAIが発表した「Control-LoRAs」の線画抽出機能「Canny」。ComfyUIでサンプルのワークフローを動作させている様子。左下で入力した画像が、線が抽出され、右側の画像になって出力される
Fooocusは、こうした複雑化していく画像生成AIの環境そのものへの強烈なカウンターになり、初心者には難しいと考えられていたSDXLのハードルを一気に引き下げました。「画像にメタデータを入れるのが当たり前」と思われていた大手の考え方に対するカウンターにもなっています。さらに、Fooocus自身もFooocus-MREのようなカウンターも受けて発展していく。こうした意外な成長の仕方をしていくのもオープンソースコミュニティの強みであり、とてつもなくイノベーションが早い理由になっているように感じます。

この連載の記事
-
第148回
AI
AIが15万字の小説を1週間で執筆──「Claude Opus 4.6」が示した創作の未来 -
第147回
AI
ゲーム開発開始から3年、AIは“必須”になった──Steam新作「Exelio」の舞台裏 -
第146回
AI
ローカル音楽生成AIの新定番? ACE-Step 1.5はSuno連携で化ける -
第145回
AI
ComfyUI、画像生成AI「Anima」共同開発 アニメ系モデルで“SDXL超え”狙う -
第144回
AI
わずか4秒の音声からクローン完成 音声生成AIの実力が想像以上だった -
第143回
AI
AIエージェントが書いた“異世界転生”、人間が書いた小説と見分けるのが難しいレベルに -
第142回
AI
数枚の画像とAI動画で“VTuber”ができる!? 「MotionPNG Tuber」という新発想 -
第141回
AI
AIエージェントにお金を払えば、誰でもゲームを作れてしまうという衝撃の事実 開発者の仕事はどうなる? -
第140回
AI
3Dモデル生成AIのレベルが上がった 画像→3Dキャラ→動画化が現実的に -
第139回
AI
AIフェイクはここまで来た 自分の顔で試して分かった“違和感”と恐怖 -
第138回
AI
数百万人が使う“AI彼女”アプリ「SillyTavern」が面白い - この連載の一覧へ






