Stability AIが誇る最新世代モデル「Stable Diffusion 3(SD3) / 3.5」。
従来のSDXLやSD 1.5からアーキテクチャが「MMDiT(マルチモーダルDiffusion Transformer)」へと刷新され、表現力が大幅に強化されました。
この記事では、SD3 / SD 3.5の主な進化ポイント、SDXLとの違い、ローカル実行時の注意点を解説します。
💡 関連記事:
・画像生成AI全体の比較は「画像生成AIおすすめ比較まとめ」をご覧ください。
・実機での詳細レビューは「Stable Diffusion 3実機レビュー」で解説しています。
SD 3 / 3.5の主な進化ポイント
| 進化項目 | 詳細 |
|---|---|
| 1. 文字・タイポグラフィ描画 | 画像内の看板やTシャツなどに、指定した英語スペルを破綻なく描画可能に。 |
| 2. 複雑なプロンプトへの追従 | 「赤い服を着て青い傘を持った女性」など、複数の要素と位置関係を混同せず正確に再現。 |
| 3. バリエーション展開 | 大型モデル「SD 3.5 Large」、軽量モデル「SD 3.5 Medium」、高速生成「Turbo」などがラインナップ。 |
まとめ:オープンソース画像生成の新たなスタンダード
プロンプト理解力と文字描画の正確さを求める方は、ぜひSD 3.5シリーズを試してみてください。