あるユーザーが、DeepSeek V4 Flashモデルを2、3、4ビット量子化されたGGUF形式に変換したHugging Faceリポジトリへのリンクを投稿しました。
- 利用可能なモデルは、DeepSeek V4 Flashの2ビット、3ビット、4ビット量子化版です。
- ファイルは、ユーザーtarrudaのプロフィールにあるHugging Faceプラットフォーム上にホストされています。
あるユーザーが、DeepSeek V4 Flashモデルを2、3、4ビット量子化されたGGUF形式に変換したHugging Faceリポジトリへのリンクを投稿しました。
DeepSeek AIは、100万トークンのコンテキストウィンドウと、グローバルキャッシュのフットプリントをトークンあたり890バイトに削減するFP4 KVキャッシュを備えたマルチモーダルMixture-of-ExpertsモデルであるDeepSeek-V4.1-Flashをリリースしました。このモデルは、因果的なエンコーダ・デコーダアーキテクチャとCompressed Sparse Attention 2 (CSA2) を活用し、パフォーマンスを維持しながらメモリ要件を大幅に削減しています。
DeepSeek-AIは、長文コンテキストのトレーニングと推論の効率を向上させるためにDeepSeek Sparse Attention (DSA)を導入した実験的モデルであるDeepSeek-V3.2-Expをリリースしました。
DeepSeekは新しいモデル「DeepSeek V4-1 Flash」をリリースしました。これは、5520億パラメータのバックボーンを持つマルチモーダルMixture-of-Experts (MoE)モデルです。
DeepSeekは、ネイティブなマルチモーダル視覚理解機能を備えた新アーキテクチャシリーズの最小型モデルであるDeepSeek V4.1 Flashを正式にリリースした。因果的エンコーダ・デコーダ設計に基づき、入力側で8Bパラメータ、出力側で16Bパラメータのみを活性化させる552BパラメータのMixture of Experts (MoE)モデルである。
IFMは、Mixture-of-Values注意機構を搭載し、36Bのパラメータを保存しながらトークンごとに4Bのみを実行するMixture-of-ExpertsモデルであるK2-Horizon-MoVA-36B-A4Bの最終チェックポイントをリリースしました。リリースにはGGUF形式とK2-Horizonファミリー内のより小さなバリアントへのリンクが含まれています。
アクセス解析とサイト改善のために Cookie を使用します。分析 Cookie を許可または拒否できます。 プライバシーポリシー