llama.cppプロジェクトはビルドb11048をリリースし、qwen4expで使用される新しいDSV4 HC演算バリアントのサポートを導入しました。このアップデートには、要素ごとのシグモイドゲートを持つhc_preと恒等混合を持つhc_postの具体的な実装が含まれます。

  • 要素ごとのシグモイドゲート付きqwen4exp hc_preのサポート(ゲート付きバリアント)
  • 恒等混合付きqwen4exp hc_postのサポート (comb == nullptr)
  • CPU、GPU、CUDA、ROCm、OpenVINOなどの専用バックエンドを含むmacOS、Linux、Windows、Android、openEuler向けの新しいバイナリが利用可能になりました。

このリリースにより、ユーザーはこれらの特定のハードウェアアクセラレーション演算を利用するモデルを、幅広いサポート対象プラットフォームで実行できるようになります。