llama.cpp プロジェクトはバージョン b10203 をリリースし、SYCL ベースの行列乗算操作で q2_0 量子化フォーマットのサポートを導入しました。このアップデートは、特定のハードウェア加速シナリオにおけるライブラリの互換性を拡大します。

  • PR #26231 により mul_mat で q2_0 のサポートを追加。
  • SYCL バックエンド内の追加の q2_0 ケースへの対応範囲を拡張。
  • macOS (Apple Silicon および Intel)、iOS、Linux (CPU、Vulkan、ROCm 7.2、OpenVINO、SYCL FP32/FP16)、Android、Windows (CPU、OpenCL、CUDA 12/13、Vulkan、OpenVINO、SYCL、HIP)、openEuler 用のバイナリを提供。

このリリースにより、ユーザーは SYCL 互換デバイスで q2_0 量子化を利用できるようになり、効率的なモデル推論のためのサポート対象ハードウェア構成の範囲が広がります。