DeepSeek a lancé son nouveau modèle, DeepSeek V4-1 Flash. C'est un modèle Mixture-of-Experts (MoE) multimodal disposant d'une base de 552 milliards de paramètres.

  • Le modèle prend en charge des contextes allant jusqu'à un million de tokens.
  • Il utilise une architecture Mixture-of-Experts multimodale avec 552B de paramètres.