DeepSeek telah merilis model barunya, DeepSeek V4-1 Flash. Ini adalah model Mixture-of-Experts (MoE) multimodal yang memiliki backbone dengan 552 miliar parameter.

  • Model ini mendukung konteks hingga satu juta token.
  • Model ini menggunakan arsitektur Mixture-of-Experts multimodal dengan 552B parameter.