新しいDeepSeek V4-Flashモデルは、ArtificialAnalysis指数で50のスコアを達成しました。この結果により、GLM-5.2およびGPT-5.6 Lunaにわずか1ポイント及ばない位置にあります。
media
r/LocalLLaMA
·
1時間前
·
open_models
DeepSeek V4-FlashがArtificialAnalysis指数で50を達成
翻訳元 English → 日本語
ベンチマーク
| ベンチマーク | モデル | スコア |
|---|---|---|
| Artificial Analysis Intelligence Index | DeepSeek V4-Flash | 50% |
関連記事
media
MarkTechPost
·
12日前
·
9 回表示
ベンチマーク、ライセンス、推論コストで比較されるKimi K3、DeepSeek V4 Pro、GLM-5.2
Moonshot AIのKimi K3、DeepSeek V4 Pro、Zhipu AIのGLM-5.2という3つのオープンウェイトなスパースMixture-of-Expertsモデルの比較は、長期のコーディングおよびエージェントワークロードにおけるその能力、ライセンス条項、推論コストを評価するものである。
media
r/LocalLLaMA
·
たった今
ライブ
DeepSeek-V4-Flash-0731がベンチマークでDeepSeek-V4-Pro-Previewを上回る
DeepSeek-V4-Flash-0731モデルは、さまざまなベンチマークテストでDeepSeek-V4-Pro-Previewを大幅に上回るパフォーマンスを示しています。
media
r/LocalLLaMA
·
2時間前
DeepSeek-V4-Flash-0731 が同じコストで GLM 5.2 を上回る
DeepSeek-V4-Flash-0731 モデルは、前任と同じ価格を維持しながら GLM 5.2 よりも優れたパフォーマンスを発揮します。
media
r/LocalLLaMA
·
2時間前
DeepSeek V4 FlashのTerminal BenchおよびToolathlonスコアが改善されたアップデート
DeepSeekはV4 Flashモデルを更新し、2026-07-31にリリースされた新バージョンは、以前のプレビュー版と比較して大幅なパフォーマンス向上を示している。今回のアップデートでは、いくつかの新規ベンチマークの結果が導入され、既存のベンチマークでもスコアが改善された。
arxiv
arXiv cs.CL
·
3日前
PIVOTはクエリグループ間でプレフィックススキャンを共有し、トークンレベルのスパースアテンションを高速化する
PIVOT(Proxy Indexing Via One full-prefix Traversal)は、DeepSeek Sparse Attention(DSA)インデクサのためのトレーニング不要なドロップイン置換であり、近くのクエリグループ間で1つのプレフィックススキャンを共有することで計算の冗長性を削減します。各クエリに対して個別にすべての先行トークンをスコアリングする代わりに、PIVOTはグループを単一のプロキシクエリに集約して候補セットを取得し、そこから各クエリのためにトップkトークンが選択されます。