A DeepSeek lançou oficialmente o modelo DeepSeek-V4.1-Flash, que serve como o menor membro de sua nova família de arquiteturas e apresenta compreensão visual multimodal nativa. Esta nova arquitetura é projetada para fornecer um teto de capacidade mais alto, velocidades de inferência mais rápidas, maior throughput e melhor potencial de escalabilidade para modelos maiores.

  • O modelo alcança pontuações de 90.9 no GPQA Diamond, 36.8 no HLE e 3471 no Codeforces.
  • Ele agora está disponível na API da DeepSeek sob o nome "deepseek-flash", substituindo as variantes V4 Flash aposentadas.
  • As solicitações ao modelo deepseek-v4-pro aposentado serão roteadas para o V4.1 Flash a partir de 14 de setembro de 2026, pelo novo preço mais baixo.
  • Os preços da API foram ajustados para baixo para refletir o lançamento deste novo modelo.

A DeepSeek afirma que testes extensivos mostram que o V4.1 Flash supera o anterior DeepSeek V4 Pro em desempenho, custo, velocidade e tempo total.