O Google publicou um cartão de modelo para o Gemini 2.0 Flash, um modelo nativamente multimodal na série Gemini 2.0 projetado para impulsionar sistemas agênticos. O modelo melhora o Gemini 1.5 Flash com qualidade aprimorada e supera o Gemini 1.5 Pro em benchmarks-chave com o dobro da velocidade.
- Suporta entradas de texto, imagens, áudio e vídeo com uma janela de contexto de 1.048.576 tokens.
- Alcança 77,6% no MMLU-Pro, 34,5% no LiveCodeBench (v5) e 90,9% nos benchmarks MATH.
- Oferece suporte de baixa latência para streaming em tempo real via Multimodal Live API.
- Treinado usando as Unidades de Processamento Tensorial (TPUs) do Google com JAX e ML Pathways.
O modelo é posicionado como um caminho de atualização para usuários que buscam qualidade aprimorada ou desempenho ligeiramente melhor com capacidades de latência em tempo real.