Google представила Gemini Omni 1.1 Flash — новый набор творческих инструментов и возможностей генерации видео, предназначенный для подготовки модели к промышленному использованию профессионалами через Gemini API в Google AI Studio.

  • Расширение сцены позволяет модели анализировать до 10 секунд предыдущего контекста для продолжения генерации кадровыми фрагментами по 10 секунд до общей длительности 40 секунд.
  • Разработчики могут задавать первый и последний кадры для создания непрерывного видео между ключевыми кадрами, обеспечивая плавные переходы и движения камеры.
  • Создание видео в разрешении 360p выполняется на 60% быстрее и стоит в три раза дешевле по сравнению со стандартным разрешением 720p.
  • Модель поддерживает апскейлинг результатов до разрешения 1080p или 4K для получения качественных изображений высокого разрешения.
  • Мультимодальный ввод теперь позволяет ссылаться на видео длительностью до трех секунд для сохранения визуального контекста и согласованности персонажей.

Omni 1.1 развертывается в экосистеме разработчиков Google, включая Google AI Studio и платформу Gemini Enterprise Agent Platform, и доступна подписчикам Google AI Plus, Pro и Ultra в сервисе Google Flow.