Le nouveau modèle DeepSeek V4-Flash a obtenu un score de 50 à l'indice ArtificialAnalysis. Ce résultat le place à seulement un point en dessous de GLM-5.2 et GPT-5.6 Luna.
DeepSeek V4-Flash atteint 50 à l'indice ArtificialAnalysis
Benchmarks
| Benchmark | Modèle | Score |
|---|---|---|
| Artificial Analysis Intelligence Index | DeepSeek V4-Flash | 50% |
Kimi K3, DeepSeek V4 Pro et GLM-5.2 comparés sur les benchmarks, la licence et le coût de déploiement
Une comparaison de trois modèles Mixture-of-Experts à poids ouverts — Kimi K3 de Moonshot AI, DeepSeek V4 Pro et GLM-5.2 de Zhipu AI — évalue leurs capacités, leurs conditions de licence et leurs coûts de déploiement pour les charges de travail de codage et d'agents sur le long terme.
DeepSeek-V4-Flash-0731 dépasse DeepSeek-V4-Pro-Preview dans les benchmarks
Le modèle DeepSeek-V4-Flash-0731 surpasse désormais significativement DeepSeek-V4-Pro-Preview dans divers tests de benchmark.
DeepSeek-V4-Flash-0731 bat GLM 5.2 au même coût
Le modèle DeepSeek-V4-Flash-0731 surpasse GLM 5.2 tout en maintenant le même prix que son prédécesseur.
Mises à jour de DeepSeek V4 Flash avec des scores améliorés sur Terminal Bench et Toolathlon
DeepSeek a mis à jour son modèle V4 Flash, en publiant une nouvelle version le 2026-07-31 qui affiche des gains de performance significatifs par rapport à la précédente version d'aperçu. La mise à jour introduit des résultats pour plusieurs nouveaux benchmarks tout en améliorant les scores sur ceux existants.
PIVOT partage les scans de préfixe entre groupes de requêtes pour accélérer l'attention sparse au niveau des tokens
PIVOT (Proxy Indexing Via One full-prefix Traversal) est un remplacement plug-in sans entraînement pour l'indexeur DeepSeek Sparse Attention (DSA) qui réduit la redondance computationnelle en partageant un seul scan de préfixe entre un groupe de requêtes proches. Au lieu de scorer chaque token précédent pour chaque requête individuellement, PIVOT agrège le groupe en une seule requête proxy pour obtenir un ensemble de candidats, à partir duquel les top-k tokens sont sélectionnés pour chaque requête.