FLUX 3は、画像、動画、音声、アクション予測のタスクを処理するように設計された単一のマルチモーダルモデルとして紹介されています。このシステムは、さまざまなスタイルでよりリアルな創作を生み出すことを目指しています。

  • FLUX 3は統一されたマルチモーダルフローモデルとして機能します。
  • 画像、動画、音声の生成およびアクション予測をサポートします。
  • 創作はあらゆるスタイルにおいてよりリアルであると説明されています。