DeepSeek 发布了 DeepSeek-V4-Flash-0731,这是其较小的“Flash”模型的更新版本,在独立基准测试中超越了更大的 DeepSeek-V4-Pro。此次发布采用了一种新的微调流程,同时保留了原始的混合专家架构,总参数量为 2840 亿。

  • 该模型在 Artificial Analysis 的智能指数上获得 50 分,与 Gemini 3.6 Flash 持平,仅落后于 GPT-5.6 Luna 和 GLM-5.2。
  • 在基准测试中,其每项任务成本为 0.03 美元,而 GPT-5.6 Luna 为 0.05 美元,使其在智能与成本的帕累托前沿上占据一席之地。
  • 代理能力显著提升,在 GDPval-AA 上获得 1,558 Elo 分,并在 Terminal-Bench 2.1 上解决了 82.7% 的问题。
  • 权重以 MIT 许可证发布,API 定价为每百万输入令牌 0.14 美元。

此次更新表明,高度智能的模型可以经济高效地部署于客户服务和错误分类等全天候任务中,而无需依赖专有模型访问。