llama.cpp プロジェクトはバージョン b11006 をリリースし、K-Quantization フォーマットを処理するための Qualcomm Hexagon プロセッサのサポートを導入しました。このアップデートでは、Hexagon アーキテクチャ上で Q4_K および Q6_K 量子化レベル用の特定のカーネルが実装されました。
- Hexagon DSP 用の q6k および q4k カーネルの実装。
- hex-q6k カーネルのアンパック精度の向上。
- Hexagon ハードウェアでの Q4_K カーネルのサポートを追加。
本リリースでは、CUDA、ROCm、Vulkan、OpenVINO を含むさまざまな CPU および GPU バックエンド向けに、macOS、Linux、Windows、Android、openEuler 用のビルド済みバイナリが提供されています。