DeepSeek a lancé son nouveau modèle, DeepSeek V4-1 Flash. C'est un modèle Mixture-of-Experts (MoE) multimodal disposant d'une base de 552 milliards de paramètres.
- Le modèle prend en charge des contextes allant jusqu'à un million de tokens.
- Il utilise une architecture Mixture-of-Experts multimodale avec 552B de paramètres.