llama.cpp プロジェクトはビルド b10639 をリリースしました。これには、warptiles が以前にワープサイズが 64 以下であると想定していた Vulkan バックエンドの修正が含まれています。この変更により、より大きなワープに関連する問題を回避するためにワープサイズが制限されました。
今回のリリースでは、macOS (Apple Silicon および Intel)、iOS、Linux (CPU、Vulkan、ROCm、OpenVINO、SYCL)、Android、Windows (CPU、CUDA、Vulkan、OpenCL、OpenVINO、SYCL、ROCm)、openEuler 用のバイナリが提供されています。また、llama.cpp UI も含まれています。
このアップデートにより、64 より大きなワープサイズを使用するハードウェア構成との互換性が確保されます。