Black Forest Labs запустила FLUX 3, семейство мультимодальных flow-моделей, включающее возможности генерации видео с нативным аудио. В релизе также представлена FLUX-mimic, вариант, разработанный для приложений робототехники «видео-действие».
- FLUX 3 Video поддерживает генерацию текст-в-видео, изображение-в-видео и видео-в-видео, а также переходы от ключевых кадров к видео.
- Все выходные данные модели включают возможности нативной генерации аудио.
- Система обладает агентным связыванием для создания более длинных многосегментных последовательностей и поддерживает многоязычный диалог.
- Black Forest Labs также анонсировала FLUX-mimic, демонстрирующую способность модели управлять роботами и предсказывать их воздействие в заводских условиях.
Компания готовится выпустить версию Dev с открытыми весами для FLUX 3 Video.