DeepSeek ha lanzado DeepSeek v4.1-Flash, un nuevo modelo insignia de pesos abiertos que presenta una nueva arquitectura causal codificador-decodificador diseñada para maximizar la eficiencia de inferencia y reducir costos.
El modelo utiliza una estructura de mezcla de expertos con 763 mil millones de parámetros totales, pero solo activa 8B parámetros para el procesamiento de entrada y 16B para la generación de salida. Este diseño logra una dispersión del 1-2% y reduce la huella de la caché KV a una octava parte del modelo V4 Flash anterior. Admite una ventana de contexto de 1M tokens con entradas de texto e imagen bajo una licencia MIT.
Las evaluaciones independientes de Artificial Analysis y Vals clasifican a v4.1-Flash como el mejor modelo de pesos abiertos, citando su superior relación costo-rendimiento con un precio de $0.30 por millón de tokens de entrada.