DeepSeekは新しいモデル「DeepSeek V4-1 Flash」をリリースしました。これは、5520億パラメータのバックボーンを持つマルチモーダルMixture-of-Experts (MoE)モデルです。
- このモデルは最大100万トークンのコンテキストをサポートします。
- 552Bパラメータを持つマルチモーダルMixture-of-Expertsアーキテクチャを採用しています。
DeepSeekは新しいモデル「DeepSeek V4-1 Flash」をリリースしました。これは、5520億パラメータのバックボーンを持つマルチモーダルMixture-of-Experts (MoE)モデルです。