Black Forest Labs 推出了 FLUX 3,这是一个包含原生音频视频生成能力的多模态流模型家族。此次发布还引入了 FLUX-mimic,一个专为视频动作机器人应用设计的变体。
- FLUX 3 Video 支持文本到视频、图像到视频和视频到视频的生成,以及关键帧到视频的过渡。
- 模型的所有输出均包含原生音频生成能力。
- 该系统具备智能体链式功能,可创建更长的多镜头序列,并支持多语言对话。
- Black Forest Labs 还宣布了 FLUX-mimic,展示了该模型在工厂环境中驱动机器人并预测其影响的能力。
该公司正准备发布 FLUX 3 Video 的开源权重 Dev 版本。