Google представила Gemini Omni 1.1 Flash — новый набор творческих инструментов и возможностей генерации видео, предназначенный для подготовки модели к промышленному использованию профессионалами через Gemini API в Google AI Studio.
- Расширение сцены позволяет модели анализировать до 10 секунд предыдущего контекста для продолжения генерации кадровыми фрагментами по 10 секунд до общей длительности 40 секунд.
- Разработчики могут задавать первый и последний кадры для создания непрерывного видео между ключевыми кадрами, обеспечивая плавные переходы и движения камеры.
- Создание видео в разрешении 360p выполняется на 60% быстрее и стоит в три раза дешевле по сравнению со стандартным разрешением 720p.
- Модель поддерживает апскейлинг результатов до разрешения 1080p или 4K для получения качественных изображений высокого разрешения.
- Мультимодальный ввод теперь позволяет ссылаться на видео длительностью до трех секунд для сохранения визуального контекста и согласованности персонажей.
Omni 1.1 развертывается в экосистеме разработчиков Google, включая Google AI Studio и платформу Gemini Enterprise Agent Platform, и доступна подписчикам Google AI Plus, Pro и Ultra в сервисе Google Flow.