文章宣布,DeepSeek-V4-Flash-0731模型在象棋基准测试中超越了Fable-5、Sol和Kimi-K3。
源文本中未提供有关具体分数或方法论的更多详细信息。
文章宣布,DeepSeek-V4-Flash-0731模型在象棋基准测试中超越了Fable-5、Sol和Kimi-K3。
源文本中未提供有关具体分数或方法论的更多详细信息。
DeepSeek-V4-Flash-0731 模型达到了 50 的智能指数分数,这一指标与 2026 年 3 月顶级前沿模型的表现相匹配,当时的分数为 51。
Reddit上流传的一个翻译梗图表明,由于DeepSeek v4 flash带来的竞争压力,竞争对手不得不将价格降低80%。该开源模型拥有2840亿总参数和130亿活跃参数,提供了卓越的性价比指标。
DeepSeek 声称其新发布的通用模型 DeepSeek V4 Flash 在 DeepSWE 基准测试中达到了与 Anthropic's Sonnet 5 和 xAI's Grok 4.5 相同的性能水平。
DeepSeek-V4-Flash-0731模型在各种基准测试中显著优于DeepSeek-V4-Pro-Preview。
新的DeepSeek V4-Flash模型在ArtificialAnalysis指数中获得了50分的成绩。这一成绩使其仅比GLM-5.2和GPT-5.6 Luna低一分。