Black Forest Labs запустила FLUX 3, семейство мультимодальных flow-моделей, включающее возможности генерации видео с нативным аудио. В релизе также представлена FLUX-mimic, вариант, разработанный для приложений робототехники «видео-действие».

  • FLUX 3 Video поддерживает генерацию текст-в-видео, изображение-в-видео и видео-в-видео, а также переходы от ключевых кадров к видео.
  • Все выходные данные модели включают возможности нативной генерации аудио.
  • Система обладает агентным связыванием для создания более длинных многосегментных последовательностей и поддерживает многоязычный диалог.
  • Black Forest Labs также анонсировала FLUX-mimic, демонстрирующую способность модели управлять роботами и предсказывать их воздействие в заводских условиях.

Компания готовится выпустить версию Dev с открытыми весами для FLUX 3 Video.