llama.cpp プロジェクトはバージョン b11132 をリリースし、Gemma 4 DSpark ドラフトバックボーンのサポートを導入しました。このアップデートにより、フルアテンションおよび SWA Gemma 4 ドラフトの GGUF 変換とランタイム機能が有効になり、結合された出力重みとブール型のバックボーンメタデータが含まれます。
- フルアテンションおよび SWA バリアントを持つ Gemma 4 ドラフトモデルの dspark サポートを追加。
- dflash メカニズムを介してメタデータから Gemma ドラフト特徴の推論を実装。
- macOS (Apple Silicon および Intel)、Linux (CPU、Vulkan、CUDA、ROCm、OpenVINO、SYCL、Snapdragon)、Windows (CPU、OpenCL、CUDA、Vulkan、OpenVINO、SYCL、ROCm)、Android、および iOS 用のバイナリをリリース。
このリリースにより、ユーザーは幅広いハードウェアプラットフォーム上で llama.cpp エコシステム内で Gemma 4 モデルを利用できるようになります。