llama.cpp プロジェクトはバージョン b11090 をリリースし、sm_70 タイルのコンパイルエラーの修正が含まれています。このアップデートは、Volta アーキテクチャとの不一致を解消するため、5引数 load_ldmatrix 関数のタイル形状を汎化しました。
- load_ldmatrix のタイル形状を <16,8> から <I,J> に汎化することで、sm_70 でのコンパイルエラーを修正します。
- macOS (Apple Silicon および Intel)、iOS、Linux (CPU、CUDA、ROCm、OpenVINO、SYCL)、Windows (CPU、CUDA、Vulkan、OpenCL、OpenVINO、SYCL、ROCm)、Android、および openEuler 用のバイナリを提供します。
このリリースは、幅広いオペレーティングシステムとハードウェアアクセラレータのサポートを維持しつつ、古いGPUアーキテクチャとの互換性を確保します。