DeepSeek发布了DeepSeek-V4-Flash的更新版公共测试API,并同步开放权重下载,标志着通过训练后优化而非架构变更实现了显著的性能飞跃。该模型保留了284B总参数/13B激活参数的结构,但在智能体能力和编码基准测试中展现出重大改进。

  • DeepSeek-V4-Flash API已上线,其升级的智能体能力超越V4-Pro-Preview,支持Responses API格式并适配Codex。
  • Terminal-Bench得分从56.9跃升至82.7(+25.8分),GDPval-AA v2 Elo评分从1189增至1559,且未改变模型规模或架构。
  • 开源权重以MIT许可证发布,包含256个路由专家,每个token激活6个专家,并配备DSpark推测解码模块。
  • 此次发布加剧了价格竞争,使DeepSeek在智能与成本帕累托前沿上占据有利位置,每百万token价格为$0.14/$0.28,并提供98%的缓存命中折扣。

此次更新表明,训练后优化能显著提升模型在复杂任务中的实用性,同时在与专有替代方案的竞争中保持价格优势。