A DeepSeek lançou o DeepSeek-V4-Flash-0731, uma versão atualizada de seu modelo "Flash" menor que supera o maior DeepSeek-V4-Pro em benchmarks independentes. O lançamento utiliza um novo processo de ajuste fino enquanto mantém a arquitetura original Mixture-of-Experts com 284 bilhões de parâmetros no total.
- O modelo alcança 50 pontos no Índice de Inteligência da Artificial Analysis, empatando com o Gemini 3.6 Flash e ficando atrás apenas do GPT-5.6 Luna e GLM-5.2.
- Custa $0,03 por tarefa no benchmark em comparação com $0,05 para o GPT-5.6 Luna, posicionando-o na fronteira de Pareto para inteligência versus custo.
- As capacidades agênticas melhoraram significativamente, marcando 1.558 Elo no GDPval-AA e resolvendo 82,7% dos problemas no Terminal-Bench 2.1.
- Os pesos estão disponíveis sob a licença MIT, com preços de API definidos em $0,14 por milhão de tokens de entrada.
A atualização demonstra que modelos altamente inteligentes podem ser implantados economicamente para tarefas sempre ativas, como atendimento ao cliente e triagem de bugs, sem exigir acesso a modelos proprietários.