DeepSeek telah merilis model barunya, DeepSeek V4-1 Flash. Ini adalah model Mixture-of-Experts (MoE) multimodal yang memiliki backbone dengan 552 miliar parameter.
- Model ini mendukung konteks hingga satu juta token.
- Model ini menggunakan arsitektur Mixture-of-Experts multimodal dengan 552B parameter.