A Google apresentou o Gemini Omni 1.1 Flash, um novo conjunto de controles criativos e capacidades de geração de vídeo projetadas para tornar o modelo pronto para produção em uso profissional por meio da API Gemini no Google AI Studio.
- A extensão de cena permite que o modelo analise até 10 segundos de contexto anterior para continuar gerando imagens em intervalos de 10 segundos, atingindo um comprimento total de 40 segundos.
- Os desenvolvedores podem especificar os primeiros e últimos quadros para gerar vídeo contínuo entre quadros-chave, garantindo transições suaves e movimentos de câmera.
- A criação de vídeos em resolução 360p é até 60% mais rápida e custa um terço em comparação com a resolução padrão de 720p.
- O modelo oferece suporte à ampliação das saídas para resolução 1080p ou 4K, resultando em imagens polidas e de alta resolução.
- A entrada multimodal agora permite referenciar até três segundos de vídeo para manter o contexto visual e a consistência dos personagens.
O Omni 1.1 está sendo lançado em todo o ecossistema de desenvolvedores da Google, incluindo Google AI Studio e a Plataforma Gemini Enterprise Agent, e está disponível para assinantes do Google AI Plus, Pro e Ultra no Google Flow.