Google ha presentado Gemini Omni 1.1 Flash, un nuevo conjunto de controles creativos y capacidades de generación de video diseñadas para preparar el modelo para su uso profesional a través de la API de Gemini en Google AI Studio.

  • La extensión de escena permite al modelo analizar hasta 10 segundos de contexto previo para continuar generando imágenes en incrementos de 10 segundos, con una duración total de hasta 40 segundos.
  • Los desarrolladores pueden especificar los fotogramas inicial y final para generar video continuo entre fotogramas clave, logrando transiciones fluidas y movimientos de cámara.
  • La creación de videos en resolución 360p es hasta un 60% más rápida y cuesta una tercera parte en comparación con la resolución estándar de 720p.
  • El modelo admite la ampliación de salidas a resolución 1080p o 4K para obtener resultados pulidos y de alta resolución.
  • La entrada multimodal ahora permite hacer referencia hasta tres segundos de video para mantener el contexto visual y la consistencia de los personajes.

Omni 1.1 se está implementando en todo el ecosistema de desarrolladores de Google, incluyendo Google AI Studio y la plataforma Gemini Enterprise Agent Platform, y está disponible para suscriptores de Google AI Plus, Pro y Ultra en Google Flow.