Google a publié trois nouveaux modèles dans sa gamme Flash — Gemini 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber — optimisés pour la vitesse, l'efficacité des coûts et les charges de travail agentic à fort volume plutôt que pour une profondeur maximale de raisonnement.

  • Gemini 3.6 Flash utilise 17 % moins de tokens de sortie que 3.5 Flash (jusqu'à une réduction de 65 % sur DeepSWE) et abaisse le prix de sortie de 9,00 $ à 7,50 $ par 1M de tokens, tout en obtenant de meilleurs scores sur DeepSWE (49 % contre 37 %) et MLE Bench (63,9 % contre 49,7 %).
  • Gemini 3.5 Flash-Lite offre des performances à faible latence avec 350 tokens de sortie par seconde pour 0,30 $/2,50 $ par 1M de tokens, surpassant l'ancien 3 Flash sur SWE-Bench Pro (54,2 % contre 49,6 %) et OSWorld-Verified (74,0 % contre 65,1 %).
  • Gemini 3.5 Flash Cyber est un modèle spécialisé dans la détection et le correctif des vulnérabilités logicielles, utilisé dans l'agent CodeMender pour identifier 55 problèmes uniques de V8, contre 47 pour la version principale 3.5 Flash.

Ces modèles sont disponibles via l'API Gemini, Google AI Studio, Android Studio et GitHub Copilot, avec 3.5 Flash Cyber actuellement limité aux gouvernements et partenaires de confiance en raison des risques d'usage dual.