DeepSeek lanzó la API DeepSeek-V4-Flash en beta pública e inmediatamente liberó sus pesos bajo una licencia MIT. La actualización ofrece mejoras significativas de rendimiento respecto a la vista previa de abril sin alterar la arquitectura o el tamaño del modelo, posicionándola como una alternativa rentable frente a los modelos propietarios.

  • La API Flash supera a V4-Pro-Preview en capacidades de agente y soporta el formato de Responses API.
  • Las puntuaciones de Terminal-Bench saltaron de 56.9 a 82.7, mientras que el Elo de GDPval-AA subió de 1189 a 1559.
  • El modelo conserva su conteo total de parámetros de 284B / 13B activos y una ventana de contexto de 1M.
  • El precio se fija en $0.14/$0.28 por cada 1M de tokens, con un descuento del 98% por acierto en caché que reduce los costos almacenados a $0.0028/1M.
  • Los pesos abiertos están disponibles en Hugging Face, compatibles con vLLM y despliegues cuantizados que requieren aproximadamente 168GB de RAM para una compresión sin pérdida de 4-bit.

El lanzamiento reconfigura la actual guerra de precios al ofrecer un rendimiento cercano al de los sistemas propietarios de gama alta a una fracción del costo, incentivando a los desarrolladores a integrarlo en sus pilas de código existentes.