llama.cppプロジェクトはビルドb11048をリリースし、qwen4expで使用される新しいDSV4 HC演算バリアントのサポートを導入しました。このアップデートには、要素ごとのシグモイドゲートを持つhc_preと恒等混合を持つhc_postの具体的な実装が含まれます。
- 要素ごとのシグモイドゲート付きqwen4exp hc_preのサポート(ゲート付きバリアント)
- 恒等混合付きqwen4exp hc_postのサポート (comb == nullptr)
- CPU、GPU、CUDA、ROCm、OpenVINOなどの専用バックエンドを含むmacOS、Linux、Windows、Android、openEuler向けの新しいバイナリが利用可能になりました。
このリリースにより、ユーザーはこれらの特定のハードウェアアクセラレーション演算を利用するモデルを、幅広いサポート対象プラットフォームで実行できるようになります。