DeepSeek ha lanzado su nuevo modelo, DeepSeek V4-1 Flash. Es un modelo Mixture-of-Experts (MoE) multimodal que cuenta con una base de 552 mil millones de parámetros.
- El modelo admite contextos de hasta un millón de tokens.
- Utiliza una arquitectura Mixture-of-Experts multimodal con 552B parámetros.