project
Stability AI オープンソース Stable Diffusion 3 Medium テキストベースグラフモデル
人工知能スタートアップのStability AIは、最新のテキストから画像への生成モデルであるStable Diffusion 3 Medium(SD3 Medium)の公式オープンソースリリースを発表しました。Stable Diffusion 3 Mediumには20種類のテキストから画像への変換モデルが含まれています。
6月12日夜、人工知能スタートアップ企業のStability AIは、最新のテキスト画像生成モデル「Stable Diffusion 3 Medium(SD3 Medium)」の公式オープンソース版をリリースしたと発表した。Stable Diffusion 3 Mediumは20億個のパラメータを含み、Stability AIがこれまでに開発した中で最も高度なオープンなテキスト画像生成モデルである。VRAM使用量が少ないため、コンシューマー向けGPUとエンタープライズ向けGPUの両方での動作に適している。
ハグフェイスモデルの住所:https://huggingface.co/stabilityai/stable-diffusion-3-medium
Stable Diffusion 3 Mediumに関する基本情報
- 高度な20億個のパラメータを持つSD3 Mediumは、Stability AIがこれまでに開発した中で最も複雑な画像生成モデルであり、生成型AIの進化における重要なマイルストーンとなるものです。
- 適用性このモデルは適度なサイズであるため、一般消費者向けPC、ノートパソコン、および企業向けGPUでの動作に最適であり、テキストから画像への変換モデルの新たな標準となることが期待されています。
- オープンさSD3 Mediumの重量は、非商用かつ低価格のクリエイターライセンスで利用可能となり、プロのアーティスト、デザイナー、開発者、AI愛好家による商用利用を促進します。
- マルチプラットフォーム対応APIトライアルはサポートされており、Stabilityプラットフォーム、Stable Assistant(3日間無料トライアル)、およびDiscord経由のStable Artisanで試用できます。
安定拡散3 中改善する
- フォトリアリスティックSD3 Mediumは、手や顔によく見られるアーティファクトを低減することで、複雑なワークフローを必要とせずに高品質な画像を提供します。
- 従うべきヒントこのモデルは、空間的な関係性、構成要素、動作、スタイルなどを含む複雑な手がかりを理解し、生成することができる。
- レイアウトスキルSD3 Mediumは、Diffusion Transformerアーキテクチャを活用することで、アーティファクトやスペルミスのないテキスト生成を実現します。
- 資源効率このモデルはリソース効率を考慮して設計されており、性能を犠牲にすることなく、標準的な民生用GPUでも高いパフォーマンスを維持します。
- 微調整機能SD3 Mediumは、小規模なデータセットから詳細情報を抽出することができ、カスタマイズを強力にサポートします。
パートナー
- NVIDIAStability AIとNVIDIAの協業により、NVIDIA® RTX™ GPUとTensorRT™を通じて、SD3 Mediumを含むすべてのStable Diffusionモデルにおいて、大幅なパフォーマンス向上を実現しました。
- AMDAMDは、最新のAPU、コンシューマー向けGPU、およびMI-300Xエンタープライズ向けGPUにおいて効率的な推論を実現するために、SD3 Mediumを最適化しました。
開放性とセキュリティ
- Stability AIは、オープンな生成型AIに強くコミットしています。SD3 Mediumは、Stability非営利研究コミュニティライセンスの下でリリースされており、商用利用をサポートする新しいクリエイターライセンスも同時にリリースされています。
- 当社は、SD3 Mediumの安全かつ責任ある利用を確保するため、モデルのトレーニングから導入に至るまで、包括的なセキュリティ対策を実施しています。
今後の計画
Stability AIは、ユーザーからのフィードバックに基づいてSD3 Mediumを継続的に改良し、機能を拡張し、パフォーマンスを向上させる予定です。同社の目標は、AI生成アートの新たな基準を確立し、SD3 Mediumをプロフェッショナルと愛好家の両方にとって不可欠なツールにすることです。
(ソース:)Stability AI)