新的DeepSeek V4-Flash模型在ArtificialAnalysis指数中获得了50分的成绩。这一成绩使其仅比GLM-5.2和GPT-5.6 Luna低一分。
media
r/LocalLLaMA
·
1 小时前
·
open_models
DeepSeek V4-Flash在ArtificialAnalysis指数中达到50分
译自 English → 中文
Benchmarks
| Benchmark | 模型 | 得分 |
|---|---|---|
| Artificial Analysis Intelligence Index | DeepSeek V4-Flash | 50% |
相关文章
media
MarkTechPost
·
12 天前
·
9 次浏览
Kimi K3、DeepSeek V4 Pro 和 GLM-5.2 在基准测试、许可证和服务成本方面的对比
对三种开源稀疏混合专家模型——月之暗面的 Kimi K3、DeepSeek V4 Pro 以及智谱 AI 的 GLM-5.2——进行了比较,评估了它们在长周期编码和智能体工作负载方面的能力、许可条款及服务成本。
media
r/LocalLLaMA
·
刚刚
实时
DeepSeek-V4-Flash-0731在基准测试中超越DeepSeek-V4-Pro-Preview
DeepSeek-V4-Flash-0731模型在各种基准测试中显著优于DeepSeek-V4-Pro-Preview。
media
r/LocalLLaMA
·
2 小时前
DeepSeek-V4-Flash-0731 以相同成本超越 GLM 5.2
DeepSeek-V4-Flash-0731 模型在保持与前任相同定价的同时,性能优于 GLM 5.2。
media
r/LocalLLaMA
·
2 小时前
DeepSeek V4 Flash 更新,Terminal Bench 和 Toolathlon 得分提升
DeepSeek 已更新其 V4 Flash 模型,于 2026-07-31 发布新版本,相比之前的预览版性能显著提升。此次更新引入了多个新基准测试的结果,并提升了现有基准的得分。
arxiv
arXiv cs.CL
·
3 天前
PIVOT通过跨查询组共享前缀扫描来加速令牌级稀疏注意力
PIVOT(Proxy Indexing Via One full-prefix Traversal)是一种无需训练、可即插即用的DeepSeek稀疏注意力(DSA)索引器替代方案,它通过在邻近查询组间共享单次前缀扫描来减少计算冗余。PIVOT不再为每个查询单独对每个前置令牌进行评分,而是将查询组聚合为一个代理查询以获取候选集,随后从中为每个查询选出top-k个令牌。