DeepSeekは、極限の推論効率と低コストを実現するために設計された新しいオープンウェイトのフラッグシップモデルであるV4.1-Flashをリリースしました。このモデルは、アクティブな計算量とKV/キャッシュのコストを大幅に削減するために、因果的なエンコーダ・デコーダアーキテクチャを利用しています。
- Artificial Analysis Intelligence Indexで40点を獲得し、DeepSeek V4 Pro 0813を上回りながら、1M入力トークンあたり0.30ドルというコストを実現しています。
- アーキテクチャは763Bの総パラメータを持ちますが、入力は8B、出力は16Bのみがアクティブです。
- MITライセンスの下で1Mトークンのコンテキストウィンドウをサポートし、テキストと画像の両方の入力を受け付けます。
- 独立した評価では、AutomationBench-AAでGPT-6 Astraと並ぶ69%、AA-LCR v1.1でGPT-5.6 Solと同等の84%を達成しました。
- ユーザーはコモディティハードウェア上でモデルをローカルで実行し、SSDストリーミングとオフロードにより高いスループットを実現していると報告しています。
このリリースにより、V4.1-Flashはプロプライエタリなモデルに対する費用対効果の高い代替手段として位置づけられ、価格の大幅に抑えられた強力なパフォーマンス指標を提供します。