A DeepSeek publicou o modelo oficial DeepSeek-V4-Flash-0731 no Hugging Face e migrou sua API para beta público a partir de 31 de julho de 2026. Este lançamento substitui a versão anterior de prévia por meio de re-treinamento, em vez de mudanças na arquitetura, entregando melhorias significativas em benchmarks agênticos e de codificação, mantendo o mesmo tamanho de 284B parâmetros.
- O modelo apresenta uma arquitetura MoE de 284B parâmetros com 13B ativados por token e inclui o módulo de decodificação especulativa DSpark.
- Ele alcança pontuações mais altas que V4-Pro (Preview) em todos os benchmarks agênticos publicados, incluindo 82.7 no Terminal Bench 2.1 e 54.2 no NL2Repo.
- O preço da API está definido em $0.14 por 1M de tokens de entrada e $0.28 por 1M de tokens de saída, aproximadamente um terço do custo do V4-Pro.
- Os pesos são licenciados sob MIT e sem restrições, permitindo auto-hospedagem com aproximadamente 110 GB de memória com quantização ou em um nó 4×GB300 para precisão completa.
A atualização oferece uma opção econômica para loops de agentes e tarefas de codificação, oferecendo desempenho que rivaliza com modelos mais caros enquanto permanece acessível a desenvolvedores independentes e empresas por meio da API ou auto-hospedagem.