A DeepSeek lançou uma API de beta público atualizada para o DeepSeek-V4-Flash, juntamente com a disponibilidade imediata dos pesos abertos, marcando um salto significativo no desempenho alcançado por meio de otimizações pós-treinamento, em vez de mudanças na arquitetura. O modelo mantém sua estrutura de 284B parâmetros totais / 13B parâmetros ativos, mas apresenta melhorias substanciais nas capacidades agênticas e nos benchmarks de codificação.

  • A API do DeepSeek-V4-Flash foi lançada com capacidades de agente aprimoradas, superando o V4-Pro-Preview, suportando o formato da Responses API e a adaptação para o Codex.
  • As pontuações no Terminal-Bench saltaram de 56,9 para 82,7 (+25,8 pontos), enquanto o Elo do GDPval-AA v2 aumentou de 1189 para 1559, sem alterações no tamanho ou na arquitetura do modelo.
  • Os pesos abertos foram lançados sob a licença MIT, apresentando 256 especialistas roteados com 6 ativos por token e um módulo de decodificação especulativa DSpark.
  • O lançamento intensificou a competição de preços, posicionando a DeepSeek na fronteira de Pareto entre inteligência e custo em $0,14/$0,28 por 1M de tokens, com desconto de 98% para cache-hit.

A atualização demonstra que as otimizações pós-treinamento podem melhorar significativamente a utilidade do modelo para tarefas complexas, mantendo preços competitivos em relação às alternativas proprietárias.