DeepSeek a officiellement lancé le modèle DeepSeek-V4.1-Flash, qui est le plus petit membre de sa nouvelle famille d'architectures et présente une compréhension visuelle multimodale native. Cette nouvelle architecture est conçue pour offrir un plafond de capacité plus élevé, des vitesses d'inférence plus rapides, un débit supérieur et un meilleur potentiel de mise à l'échelle pour les modèles plus grands.
- Le modèle obtient des scores de 90.9 sur GPQA Diamond, 36.8 sur HLE et 3471 sur Codeforces.
- Il est désormais disponible sur l'API DeepSeek sous le nom "deepseek-flash", remplaçant les variantes V4 Flash retirées.
- Les requêtes vers le modèle deepseek-v4-pro retiré seront routées vers V4.1 Flash à partir du 14 septembre 2026, au nouveau prix plus bas.
- Les tarifs de l'API ont été ajustés à la baisse pour refléter le lancement de ce nouveau modèle.
DeepSeek affirme que des tests approfondis montrent que V4.1 Flash surpasse l'ancien DeepSeek V4 Pro en termes de performance, coût, vitesse et temps total.