DeepSeek ha publicado el modelo oficial DeepSeek-V4-Flash-0731 en Hugging Face y ha trasladado su API a beta pública a partir del 31 de julio de 2026. Este lanzamiento reemplaza la versión previa anterior mediante repost-training en lugar de cambios arquitectónicos, ofreciendo mejoras significativas en benchmarks agénticos y de codificación mientras mantiene el mismo tamaño de 284B parámetros.

  • El modelo cuenta con una arquitectura MoE de 284B parámetros con 13B activados por token e incluye el módulo de decodificación especulativa DSpark.
  • Alcanza puntuaciones más altas que V4-Pro (Preview) en todos los benchmarks agénticos publicados, incluyendo 82.7 en Terminal Bench 2.1 y 54.2 en NL2Repo.
  • Los precios de la API se fijan en $0.14 por cada 1M de tokens de entrada y $0.28 por cada 1M de tokens de salida, aproximadamente un tercio del costo de V4-Pro.
  • Los pesos tienen licencia MIT y están sin restricciones, permitiendo el autoalojamiento con aproximadamente 110 GB de memoria con cuantización o en un nodo 4×GB300 para precisión completa.

La actualización ofrece una opción rentable para bucles de agentes y tareas de codificación, proporcionando un rendimiento que rivaliza con modelos más costosos mientras permanece accesible para desarrolladores independientes y empresas a través de la API o el autoalojamiento.