Google ha presentado Gemini Omni 1.1 Flash, un nuevo conjunto de controles creativos y capacidades de generación de video diseñadas para preparar el modelo para su uso profesional a través de la API de Gemini en Google AI Studio.
- La extensión de escena permite al modelo analizar hasta 10 segundos de contexto previo para continuar generando imágenes en incrementos de 10 segundos, con una duración total de hasta 40 segundos.
- Los desarrolladores pueden especificar los fotogramas inicial y final para generar video continuo entre fotogramas clave, logrando transiciones fluidas y movimientos de cámara.
- La creación de videos en resolución 360p es hasta un 60% más rápida y cuesta una tercera parte en comparación con la resolución estándar de 720p.
- El modelo admite la ampliación de salidas a resolución 1080p o 4K para obtener resultados pulidos y de alta resolución.
- La entrada multimodal ahora permite hacer referencia hasta tres segundos de video para mantener el contexto visual y la consistencia de los personajes.
Omni 1.1 se está implementando en todo el ecosistema de desarrolladores de Google, incluyendo Google AI Studio y la plataforma Gemini Enterprise Agent Platform, y está disponible para suscriptores de Google AI Plus, Pro y Ultra en Google Flow.