llama.cpp プロジェクトはビルド b10756 をリリースし、VK_KHR_shader_bfloat16 拡張機能がハードウェアでサポートされている場合にのみその拡張機能を要求するように Vulkan バックエンドの動作を変更しました。

この更新により、サポートされていない拡張機能を要求することで一部の GPU で失敗する可能性があった互換性の問題が解決されました。今回のリリースには、macOS (Apple Silicon および Intel)、Linux (CPU、Vulkan、ROCm、OpenVINO、SYCL)、Windows (CPU、CUDA 12/13、Vulkan、OpenCL、ROCm、SYCL)、Android、iOS 用のバイナリが含まれています。

この変更により、bfloat16 シェーダー拡張機能をサポートしていないデバイスでも Vulkan ベースの推論が正しく実行されることが保証されます。