DeepSeek lanzó una API de beta pública actualizada para DeepSeek-V4-Flash junto con la disponibilidad inmediata de pesos abiertos, marcando un salto significativo en el rendimiento logrado mediante optimizaciones post-entrenamiento en lugar de cambios arquitectónicos. El modelo conserva su estructura de 284B parámetros totales / 13B parámetros activos, pero muestra mejoras sustanciales en capacidades agénticas y benchmarks de codificación.
- La API de DeepSeek-V4-Flash se lanzó con capacidades de agente mejoradas que superan a V4-Pro-Preview, compatible con el formato Responses API y adaptación para Codex.
- Las puntuaciones de Terminal-Bench saltaron de 56.9 a 82.7 (+25.8 puntos), mientras que Elo GDPval-AA v2 aumentó de 1189 a 1559 sin cambios en el tamaño del modelo ni en la arquitectura.
- Los pesos abiertos se publicaron bajo la licencia MIT, con 256 expertos enrutados y 6 activos por token, además de un módulo de descodificación especulativa DSpark.
- El lanzamiento intensificó la competencia de precios, posicionando a DeepSeek en la frontera de Pareto entre inteligencia y costo a $0.14/$0.28 por 1M tokens con un descuento del 98% por acierto de caché.
La actualización demuestra que las optimizaciones post-entrenamiento pueden mejorar significativamente la utilidad del modelo para tareas complejas mientras mantiene precios competitivos frente a alternativas propietarias.