llama.cpp 프로젝트는 빌드 b10756을 출시했으며, 이는 하드웨어에서 지원되는 경우에만 VK_KHR_shader_bfloat16 확장을 요청하도록 Vulkan 백엔드 동작을 수정합니다.
이 업데이트는 지원되지 않는 확장을 요청하면 일부 GPU에서 실패할 수 있는 호환성 문제를 해결합니다. 이번 릴리스에는 macOS(Apple Silicon 및 Intel), Linux(CPU, Vulkan, ROCm, OpenVINO, SYCL), Windows(CPU, CUDA 12/13, Vulkan, OpenCL, ROCm, SYCL), Android 및 iOS용 바이너리가 포함되어 있습니다.
이 변경으로 bfloat16 shader 확장을 지원하지 않는 장치에서도 Vulkan 기반 추론이 올바르게 실행되도록 보장합니다.