DeepSeek a publié DeepSeek-V4-Flash-0731, une version mise à jour de son modèle « Flash » plus petit qui surpasse le plus grand DeepSeek-V4-Pro sur des benchmarks indépendants. Cette publication utilise un nouveau processus de réglage fin tout en conservant l'architecture originale Mixture-of-Experts avec 284 milliards de paramètres au total.

  • Le modèle obtient 50 points à l'Intelligence Index d'Artificial Analysis, égalisant Gemini 3.6 Flash et ne devançant que GPT-5.6 Luna et GLM-5.2.
  • Il coûte 0,03 $ par tâche sur le benchmark contre 0,05 $ pour GPT-5.6 Luna, le plaçant sur la frontière de Pareto pour l'intelligence par rapport au coût.
  • Les capacités agentices ont considérablement progressé, atteignant 1 558 Elo sur GDPval-AA et résolvant 82,7 % des problèmes sur Terminal-Bench 2.1.
  • Les poids sont disponibles sous licence MIT, avec un prix d'API fixé à 0,14 $ par million de tokens d'entrée.

Cette mise à jour démontre que des modèles hautement intelligents peuvent être déployés de manière économique pour des tâches en continu comme le service client et le triage des bugs, sans nécessiter d'accès à un modèle propriétaire.