ニュース
Black Forest Labsが、マルチモーダルな基本モデルであるFLUX 3をリリースしました。
Black Forest Labsは、画像、動画、音声を統一されたアーキテクチャ内で初めて同時に学習するマルチモーダル基盤モデル「FLUX 3」を発表しました。Self-Flowテクノロジーをベースとしたこのモデルは、テキスト生成動画モードと画像生成動画モードをサポートし、ネイティブ音声付きの最大20秒の動画を1回の処理で生成できます。また、複数のモーダル間の物理的制約を通して世界表現を学習することで、ロボット操作タスクにおいて優れた性能を発揮します。