llama.cpp プロジェクトはバージョン b11132 をリリースし、Gemma 4 DSpark ドラフトバックボーンのサポートを導入しました。このアップデートにより、フルアテンションおよび SWA Gemma 4 ドラフトの GGUF 変換とランタイム機能が有効になり、結合された出力重みとブール型のバックボーンメタデータが含まれます。

  • フルアテンションおよび SWA バリアントを持つ Gemma 4 ドラフトモデルの dspark サポートを追加。
  • dflash メカニズムを介してメタデータから Gemma ドラフト特徴の推論を実装。
  • macOS (Apple Silicon および Intel)、Linux (CPU、Vulkan、CUDA、ROCm、OpenVINO、SYCL、Snapdragon)、Windows (CPU、OpenCL、CUDA、Vulkan、OpenVINO、SYCL、ROCm)、Android、および iOS 用のバイナリをリリース。

このリリースにより、ユーザーは幅広いハードウェアプラットフォーム上で llama.cpp エコシステム内で Gemma 4 モデルを利用できるようになります。