A DeepSeek lançou o V4.1-Flash, um novo modelo principal de pesos abertos projetado para extrema eficiência de inferência e baixo custo. O modelo utiliza uma arquitetura de codificador-decodificador causal para reduzir significativamente os custos de computação ativa e de KV/cache.
- Ele pontua 40 no Índice de Inteligência da Artificial Analysis, superando o DeepSeek V4 Pro 0813 enquanto custa US$ 0,30 por 1M de tokens de entrada.
- A arquitetura possui 763B parâmetros totais, com apenas 8B ativos para entrada e 16B ativos para saída.
- Ele suporta uma janela de contexto de 1M de tokens e aceita entradas de texto e imagem sob uma licença MIT.
- Avaliações independentes mostram que ele empata com o GPT-6 Astra no AutomationBench-AA em 69% e iguala o GPT-5.6 Sol no AA-LCR v1.1 em 84%.
- Usuários relatam executar o modelo localmente em hardware comum, alcançando alta taxa de transferência por meio de streaming de SSD e descarregamento.
O lançamento posiciona o V4.1-Flash como uma alternativa econômica aos modelos proprietários, oferecendo fortes métricas de desempenho por uma fração do preço.