Proyek llama.cpp telah merilis build b10921, yang mencakup perbaikan untuk WebGPU dengan menyelaraskan ikatan tensor ke ukuran blok tipe. Perubahan ini memastikan bahwa tampilan kuantisasi blok menerima offset elemen yang valid di shader dengan berjalan mundur pada offset ikatan hingga jarak ke tensor merupakan bilangan bulat blok.
Rilis ini menyediakan biner dan framework untuk macOS (Apple Silicon dan Intel), iOS, Linux (Ubuntu dengan backend CPU, Vulkan, ROCm, OpenVINO, dan SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, dan ROCm), dan openEuler.
Pembaruan ini memastikan penanganan tensor yang benar di shader WebGPU sambil mempertahankan dukungan di berbagai arsitektur perangkat keras dan implementasi backend.