AB
AiBoss
project

Stable Diffusion 3 - Stability AIによる次世代画像生成モデル

Stable Diffusion 3は、Stability AIが開発した高度なテキスト画像生成モデルです。Stable Diffusionシリーズの最新版であり、テキストプロンプトから高品質の画像を生成するように設計されています。

安定拡散3とは何ですか?

Stable Diffusion 3は、Stability AIが開発した高度なテキスト画像生成モデルです。Stable Diffusionシリーズの最新バージョンであり、テキストプロンプトから高品質な画像を生成するように設計されています。前バージョンと比較して、テキストレンダリング機能、複数トピックプロンプト機能、画像品質など、いくつかの重要な点で改良されており、生成される画像の品質と多様性が大幅に向上しています。

安定拡散3の主な特徴

  • テキストレンダリング機能の向上Stable Diffusion 3は、テキストレンダリングにおいて大幅な改善を実現し、テキストを含む画像をより正確に生成し、文字化けやエラーを低減します。
  • スケーラブルなパラメータ数Stable Diffusion 3は、800Mから8Bまでの様々なサイズのモデルを提供しており、携帯機器を含む様々なデバイスで動作させることが可能で、大規模AIモデルの利用における参入障壁を低くしています。
  • 複数トピックのヒントに対応新モデルはマルチテーマプロンプトに対応しており、ユーザーは単一のテキストプロンプトで複数の要素やテーマを含む複雑な画像を生成できるため、創造性の柔軟性が向上します。
  • 画質の向上Stable Diffusion 3は画質を最適化し、より高い解像度と優れた色飽和度を実現することで、よりリアルで詳細な画像を提供します。
  • 拡散トランスフォーマーアーキテクチャこのモデルは、トランスフォーマーモデルと拡散モデルを組み合わせた技術である拡散トランスフォーマー(DiTアーキテクチャ)を採用しており(openAIのSoraもこの技術を使用しています)、モデルの効率と生成される画像の品質を向上させています。
  • 流量マッチング技術Stable Diffusion 3は、サンプリング効率を向上させるための手法であるフローマッチングも採用しています。これは、固定された条件付き確率パスを回帰することでシミュレーション不要のトレーニングを実現し、モデルのトレーニング速度とサンプリング速度を向上させます。

Stable Diffusion 3 の使い方

Stable Diffusion 3のリリースは、生成AIとオープンソースの分野、特に画像生成とテキスト理解において、大きな進歩を意味します。現在、Stable Diffusion 3は一般公開されていませんが、ユーザーは試用版を申請することができます。

Stable Diffusion 3によって生成された画像サンプル