DeepSeekは、新しいオープンウェイトのフラッグシップモデルであるDeepSeek v4.1-Flashをリリースしました。このモデルは、推論効率を最大化しコストを削減するために設計された新たな因果エンコーダ・デコーダアーキテクチャを採用しています。

このモデルは7630億個の総パラメータを持つ混合专家構造を利用していますが、入力処理には8B個のパラメータのみを活性化し、出力生成には16B個を活性化します。この設計により1-2%のスパースティが達成され、KVキャッシュのフットプリントは以前のV4 Flashモデルの8分の1に削減されます。MITライセンスの下でテキストと画像の入力に対応した1Mトークンのコンテキストウィンドウをサポートしています。

Artificial AnalysisおよびValsからの独立したベンチマークでは、v4.1-Flashがトップのオープンウェイトモデルとしてランク付けされており、入力トークン100万個あたり$0.30という価格で優れたコストパフォーマンス比が指摘されています。