10月23日、「Stable Diffusion 3.5(SD3.5)」が突然発表されました。6月の「Stable Diffusion 3 Middle」の大失敗でだいぶ反省したようで、Stablity AIは公式発表で「コミュニティーの期待にこたえられなかったため、コミュニティーからのフィードバックにこたえた」と述べています。ライセンス条件も大きく変わって、フラッグシップモデルの「SD3.5 Large」も、高速版の「SD3.5 Turbo」、10月29日発表された軽量版「SD3.5 Middle」のすべてが同じ条件となり、誰でもウエイトモデルを落として、気軽に利用することができるようになりました。ただ、発表されたスコアや、実際に触ってみた印象からすると、他社に比べてずば抜けた性能を実現しているというわけでもありません。それでも、画像生成AIコミュニティーの奪還に向けて、積極的に攻めた内容ではあるようです。
※記事配信先の設定によっては図版や動画等が正しく表示されないことがあります。その場合はASCII.jpをご覧ください
トップ性能というわけではない
実際、性能は最先端ではあるものの、SD3.5Lはトップ性能とまでは言えません。Stability AIが発表した他の画像生成AIと比較した性能表によると、プロンプトへの追従性(Prompt Adherence)については、Black Forest Labの「Flux.1 dev」に勝っているとしているものの、美的品質(Aesthetic Quality)では、Flux.1 Devに劣っているという結果を公開しています。このElo Scoreというのは、様々なAIの性能を比較するテストを実施しているArtificial Analysisというサイトの評価スコアで、Stability AIの発表ではオープン化されているものだけが掲載されています。
実は、最新のチャートによると、クローズドモデルの「Midjounery v6.1」や「Flux.1 Pro」には、追従性も、美的品質でも若干ですが劣ったスコアになっています。それでも、SD3の発表時にはクローズドにしていた「Large」まで、オープン化を図ってきたのにはかなり攻めた姿勢と言えるでしょう。
この連載の記事
-
第86回
AI
イラストに強すぎる画像生成AIモデル SDXL系「NoobAI-XL」の衝撃 -
第85回
AI
3DモデリングにAI革命の兆し 1枚のイラストから3Dデータが完成 -
第85回
AI
誰でもVTuber時代へ フェイシャルAI技術、続々登場 -
第83回
AI
リアルすぎてキモい 動画AIの進化が止まらない -
第82回
AI
もはや実写と間違えるレベル 動画生成AI「Runway」の進化がすごい -
第81回
AI
AIイラスト、こうしてゲームに使っています -
第80回
AI
ゲーム開発はAI活用が当たり前になりつつあるが、面白さを作り出すのは人間の仕事 -
第79回
AI
AIが考える“アイドル”がリアルすぎた グーグル「Imagen 3」なぜ高品質? -
第78回
AI
話題の画像生成AI「FLUX.1」 人気サービス「Midjourney」との違いは -
第77回
AI
画像生成AI「FLUX.1」が相当ヤバい LoRAで画風の再現も簡単に - この連載の一覧へ