Google a présenté trois nouveaux modèles de sa série Gemini : Gemini 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber, conçus pour améliorer l'efficacité des tokens, la latence et la fiabilité des agents IA en production.
- Gemini 3.6 Flash réduit l'utilisation des tokens de sortie de 17 % par rapport à 3.5 Flash sur l'indice Artificial Analysis, avec une réduction allant jusqu'à 65 % sur les benchmarks DeepSWE, tout en abaissant les coûts à 1,50 $/1M tokens d'entrée et 7,50 $/1M tokens de sortie.
- Gemini 3.5 Flash-Lite offre 350 tokens de sortie par seconde selon l'indice Artificial Analysis, avec un tarif de 0,3 $/1M tokens d'entrée et 2,5 $/1M tokens de sortie pour les flux de travail agents à haut débit.
- Gemini 3.5 Flash Cyber est un modèle spécialisé couplé à CodeMender pour les applications de cybersécurité, actuellement disponible dans le cadre d'un programme pilote à accès limité pour les gouvernements et les partenaires de confiance.
Ces lancements visent à fournir aux développeurs des outils plus rentables et efficaces pour mettre à l'échelle des tâches agents complexes, le traitement de documents et la détection des vulnérabilités de sécurité.