A Google apresentou três novos modelos em sua série Gemini: Gemini 3.6 Flash, 3.5 Flash-Lite e 3.5 Flash Cyber, projetados para melhorar a eficiência de tokens, latência e confiabilidade para agentes de IA em produção.

  • O Gemini 3.6 Flash reduz o uso de tokens de saída em 17% em comparação ao 3.5 Flash no Artificial Analysis Index, com redução de até 65% nos benchmarks DeepSWE, enquanto diminui os custos para US$ 1,50 por 1M de tokens de entrada e US$ 7,50 por 1M de tokens de saída.
  • O Gemini 3.5 Flash-Lite entrega 350 tokens de saída por segundo, de acordo com o Artificial Analysis Index, oferecendo preço de US$ 0,3 por 1M de tokens de entrada e US$ 2,5 por 1M de tokens de saída para fluxos de trabalho agênticos de alta vazão.
  • O Gemini 3.5 Flash Cyber é um modelo especializado emparelhado com o CodeMender para aplicações de cibersegurança, atualmente disponível em um programa piloto de acesso limitado para governos e parceiros confiáveis.

Esses lançamentos visam fornecer aos desenvolvedores ferramentas mais econômicas e eficientes para escalar tarefas agênticas complexas, processamento de documentos e detecção de vulnerabilidades de segurança.