Google a déployé Gemini 3.7 Flash, son nouveau modèle de milieu de gamme pour le codage et les flux de travail agents, avec une réduction de prix d'introduction de 50 % et des gains significatifs aux benchmarks par rapport à la version 3.6. Ce lancement positionne le modèle comme un outil central pour le développement, avec une intégration immédiate dans l'API Gemini, Android Studio et les outils externes tels que Cline.

  • Google annonce des scores DeepSWE de 65,3 % (contre 49,0 %) et FrontierCode de 43,6 % (contre 34,4 %), avec un prix d'introduction de 0,75 $ / 3,75 $ par 1M de tokens.
  • Artificial Analysis classe Gemini 3.7 Flash à la 56e place de son Intelligence Index, notant ~340 tok/s en sortie et une discipline améliorée dans les boucles d'outils.
  • DeepSeek a open-sourcé DeepSeek Harness sous licence MIT en tant qu'aperçu pour les développeurs, en mettant l'accent sur les plugins composable et la sémantique d'historique consciente du KV-cache.
  • Arcee a publié NAC sous Apache 2.0 pour les travaux asynchrones de longue durée, tandis qu'OpenAI a présenté le mode Ultrafast pour GPT-5.6 Sol sur du matériel Cerebras à 750 tokens/sec.

L'industrie oriente son attention vers les runtimes d'agents et les plateformes d'évaluation personnalisées alors que la latence des modèles diminue et que la complexité des interactions avec les outils augmente.