xAI a publié Grok 4.6, un modèle de 1,5T axé sur les agents à longue durée et le travail interactif, tandis qu'Alibaba a publié Qwen3.8-Max à poids ouvert et que DeepSeek a rendu V4 Pro généralement disponible avec une tarification agressive.

  • Grok 4.6 a obtenu 61 à l'Intelligence Index et 88,4 % au Terminal-Bench v2.1, facturé à 2 $/6 $ par 1M de tokens.
  • Qwen3.8-Max est un modèle MoE de 2,4T total / 95B actif avec un support jour zéro pour NVIDIA B300 et AMD MI355X.
  • DeepSeek V4 Pro GA propose une tarification d'environ 0,435 $/M en entrée et 0,87 $/M en sortie, environ 57 fois moins cher que Fable 5.
  • Microsoft a annoncé MAI-Thinking-1, son premier modèle de raisonnement conçu à partir de zéro, désormais disponible dans Foundry.
  • Solar Pro 4 d'Upstage a grimpé au rang 42 de l'Intelligence Index avec des progrès dans les tâches agentic.

Ces publications mettent en évidence un paysage concurrentiel où l'efficacité et le coût deviennent aussi critiques que les scores bruts aux benchmarks.