llama.cpp プロジェクトはバージョン b11147 をリリースし、OpenCL の新しいバイナリカーネルを導入しました。このアップデートは、A8 Q6_K non-MoE dp4a 構成のサポートを特に追加します。

  • OpenCL 用の A8 Q6_K non-MoE dp4a バイナリカーネルを追加。
  • macOS (Apple Silicon および Intel)、iOS、Linux (CPU、Vulkan、CUDA、ROCm、OpenVINO、SYCL、Snapdragon)、Android、Windows (CPU、Adreno、CUDA、Vulkan、OpenVINO、SYCL、ROCm)、openEuler 用のバイナリを提供。

このリリースにより、ユーザーは最新のカーネル最適化を使用して幅広いハードウェアプラットフォームで llama.cpp を実行できるようになります。