AB
AiBoss
project

FLUX.1 - Stable Diffusionの創設チームによって開発されたオープンソースのAI画像生成モデル。

FLUX.1は、Stable Diffusionの創設チームによって開発されたオープンソースのAI画像生成モデルです。120億個のパラメータを持つ、現在までに最大のテキストから画像への生成モデルです。FLUX.1には、最高性能のFLUX.1 [pro]、オープンソースの非商用版、そして...の3つのバリアントがあります。

FLUX.1とは何ですか?

FLUX.1は、Stable Diffusionの創設チームによって開発されたオープンソースのAI画像生成モデルです。120億個のパラメータを持つFLUX.1は、現在までに開発されたテキストベースの画像モデルの中で最大規模を誇ります。FLUX.1には、最高性能のFLUX.1 [pro]、オープンソースで非商用版のFLUX.1 [dev]、そして高速かつ効率的なFLUX.1 [schnell]の3つのバージョンがあります。FLUX.1は、優れた画質、非常にリアルな人体構造、そして高度なキューワード追従機能で際立っており、AI画像生成における新たな業界標準を確立しています。

FLUX.1の機能

  • 大規模パラメータ120億個のパラメータを持つこのモデルは、現在までに公開されているオープンソースのテキスト画像変換モデルの中で最大規模の一つです。
  • マルチモーダル建築マルチモーダルおよび並列拡散トランスフォーマーブロックのハイブリッドアーキテクチャに基づいており、強力な画像生成機能を提供します。
  • 高性能バージョン本製品には、性能や用途の異なる3つのモデルバリエーションがあり、プロフェッショナル版(FLUX.1 [pro])、開発版(FLUX.1 [dev])、高速版(FLUX.1 [schnell])が用意されています。
  • 画質視覚的な品質、指示語の遵守度、サイズ/アスペクト比の多様性、フォントおよび出力の多様性において、他の人気モデルを凌駕しています。
  • オープンソースとアクセシビリティFLUX.1 [dev]やFLUX.1 [schnell]などの一部のモデルバリアントはオープンソースであり、非商用アプリケーションでの研究や使用が容易です。
  • 技術革新フローマッチング学習手法、回転位置埋め込み、および並列アテンション層の導入により、モデルのパフォーマンスとハードウェア効率が向上します。

FLUXの技術的原理。1

  • マルチモーダル建築FLUX.1はマルチモーダルアーキテクチャを採用しており、テキストや画像など、複数の種類のデータを同時に処理・理解できるため、異なるデータ間の相関関係をより的確に捉えることができます。
  • 並列拡散トランスブロックこのモデルは、並列拡散トランスフォーマー構造を利用しており、これはシーケンスデータを効率的に処理し、モデルの情報符号化および復号化能力を向上させることができる高度なニューラルネットワークコンポーネントです。
  • ストリームマッチングのトレーニング方法FLUX.1は、フローマッチング法を用いることで、従来の拡散モデルを改良しています。この方法は、生成モデルの学習に用いられる汎用的な手法であり、学習プロセスを簡素化し、生成されるモデルの品質を向上させます。
  • 回転位置埋め込みこのモデルは、回転位置埋め込みという特殊な符号化手法を取り入れており、画像内の異なる位置にある特徴を認識するモデルの能力を高め、それによって画像の詳細表現を向上させます。
  • 並列アテンション層並列アテンション機構を用いることで、モデルは入力シーケンスの複数の部分に同時に焦点を当てることができ、これにより長距離の依存関係を捉え、生成される画像の精度を向上させることができる。

FLUX.1のプロジェクトアドレス

FLUX.1の使い方

  • 適切なモデルバリアントを選択してください
    • FLUX.1 [pro]: 最高レベルのパフォーマンスが求められ、API経由でのアクセスが必要な商用アプリケーションに適しています。
    • FLUX.1 [開発者向け]: 非商用利用向けのオープンソースのガイド付き蒸留モデルで、HuggingFace で入手可能です。
    • FLUX.1 [schnell]: ローカル開発や個人使用に適しており、最速モデルで、HuggingFaceでも入手可能です。
  • 環境設定ローカル環境でのデプロイには、Python環境をセットアップし、必要な依存ライブラリをインストールする必要があります。
  • FLUX.1をインストールしてください。Gitを使用して公式GitHubリポジトリをローカル環境にクローンし、ガイドに従って必要なPythonパッケージをインストールできます。
  • APIを使用するFLUX.1 [pro] を利用するには、登録して API キーを取得し、モデルにアクセスする必要があります。
  • コードを書く公式ドキュメントまたはサンプルコードに基づいて、モデルと連携して画像を生成するスクリプトを作成します。
  • 画像を生成するモデルが提供するインターフェースを使用してテキストプロンプトを入力すると、モデルはそのテキストに基づいて画像を生成します。

以下は、環境設定と必要な依存関係のインストールが既に完了していることを前提とした、簡単な使用例です。

# 克隆FLUX.1 GitHub仓库
git clone https://github.com/black-forest-labs/flux

# 进入仓库目录
cd flux

# 创建并激活Python虚拟环境
python3.10 -m venv .venv
source .venv/bin/activate

# 安装依赖
pip install -e '.[all]'

# 根据需要设置环境变量,例如指定模型权重路径
export FLUX_SCHNELL=path_to_flux_schnell_sft_file

# 使用提供的脚本进行图像生成
python -m flux --name 'FLUX.1 [schnell]' --loop

FLUXの応用シナリオ。1

  • メディアとエンターテインメントFLUX.1は、映画、ゲーム、アニメーション制作において、リアルな背景、キャラクター、シーンを作成するために使用できます。
  • 芸術的な創造とデザインFLUX.1を使えば高品質な画像を生成でき、アーティストやデザイナーは創造的なアイデアを迅速に実現できます。
  • 広告とマーケティング広告効果を高めるために、魅力的な広告画像やマーケティング資料を作成する。
  • 教育と研究学術研究において、FLUX.1は画像生成における新しい技術や理論を探求するためのツールとして活用できる。
  • コンテンツ作成ソーシャルメディア、ブログ、オンラインコンテンツ制作向けに独自の画像を提供し、コンテンツの魅力を高めます。