Proyek llama.cpp telah merilis build b10721, yang mencakup perbaikan kritis untuk backend WebGPU dan memperluas dukungan perangkat keras di Windows.
- Memperbaiki crash dalam implementasi `ggml_backend_tensor_get()` WebGPU ketika offset bukan kelipatan 4.
- Menambahkan dukungan pratinjau untuk Windows arm64 dengan CUDA 13.4.
- Menyediakan biner untuk macOS (Apple Silicon dan Intel), Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, dan Windows di berbagai backend CPU dan GPU.
Rilis ini memastikan stabilitas bagi pengguna WebGPU dengan offset memori yang tidak sejajar dan memperluas kompatibilitas ke arsitektur CUDA baru di Windows.