Proyek llama.cpp merilis build b10756, yang memodifikasi perilaku backend Vulkan untuk hanya meminta ekstensi VK_KHR_shader_bfloat16 ketika didukung oleh perangkat keras.

Pembaruan ini mengatasi masalah kompatibilitas di mana permintaan ekstensi yang tidak didukung dapat menyebabkan kegagalan pada beberapa GPU. Rilis ini mencakup biner untuk macOS (Apple Silicon dan Intel), Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Windows (CPU, CUDA 12/13, Vulkan, OpenCL, ROCm, SYCL), Android, dan iOS.

Perubahan ini memastikan bahwa inferensi berbasis Vulkan berjalan dengan benar pada perangkat yang tidak mendukung ekstensi shader bfloat16.