A DeepSeek lançou oficialmente o modelo DeepSeek-V4.1-Flash, que serve como o menor membro de sua nova família de arquiteturas e apresenta compreensão visual multimodal nativa. Esta nova arquitetura é projetada para fornecer um teto de capacidade mais alto, velocidades de inferência mais rápidas, maior throughput e melhor potencial de escalabilidade para modelos maiores.
- O modelo alcança pontuações de 90.9 no GPQA Diamond, 36.8 no HLE e 3471 no Codeforces.
- Ele agora está disponível na API da DeepSeek sob o nome "deepseek-flash", substituindo as variantes V4 Flash aposentadas.
- As solicitações ao modelo deepseek-v4-pro aposentado serão roteadas para o V4.1 Flash a partir de 14 de setembro de 2026, pelo novo preço mais baixo.
- Os preços da API foram ajustados para baixo para refletir o lançamento deste novo modelo.
A DeepSeek afirma que testes extensivos mostram que o V4.1 Flash supera o anterior DeepSeek V4 Pro em desempenho, custo, velocidade e tempo total.