A DeepSeek lançou seu novo modelo, o DeepSeek V4-1 Flash. É um modelo Mixture-of-Experts (MoE) multimodal que possui uma base de 552 bilhões de parâmetros.

  • O modelo suporta contextos de até um milhão de tokens.
  • Ele utiliza uma arquitetura Mixture-of-Experts multimodal com 552B parâmetros.