Google a introduit Gemini Omni 1.1 Flash, une nouvelle suite de contrôles créatifs et de capacités de génération vidéo conçue pour rendre le modèle prêt pour la production en usage professionnel via l'API Gemini dans Google AI Studio.

  • L'extension de scène permet au modèle d'analyser jusqu'à 10 secondes de contexte antérieur pour continuer à générer des séquences par incréments de 10 secondes, jusqu'à une durée totale de 40 secondes.
  • Les développeurs peuvent spécifier les première et dernière images clés pour générer une vidéo continue entre ces images clés, assurant des transitions fluides et des mouvements de caméra.
  • Le brouillon de vidéos en résolution 360p est jusqu'à 60 % plus rapide et coûte un tiers par rapport à la résolution standard 720p.
  • Le modèle prend en charge la mise à l'échelle des sorties vers une résolution 1080p ou 4K pour obtenir des résultats polis et haute résolution.
  • L'entrée multimodale permet désormais de référencer jusqu'à trois secondes de vidéo pour maintenir le contexte visuel et la cohérence des personnages.

Omni 1.1 est déployée dans l'écosystème des développeurs Google, y compris Google AI Studio et la plateforme Gemini Enterprise Agent Platform, et est disponible pour les abonnés Google AI Plus, Pro et Ultra dans Google Flow.