Proyek llama.cpp telah merilis versi b10336, yang mencakup refaktor beberapa file wgsl dan penyederhanaan flash_attn wgsl dalam komponen ggml-webgpu.
Pembaruan ini menyediakan biner untuk macOS (Apple Silicon dan Intel), iOS, Linux (Ubuntu dengan CPU, Vulkan, ROCm 7.2, OpenVINO, SYCL), Android, Windows (CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL, HIP), dan platform openEuler.
Rilis ini juga mencakup build UI standar bagi pengguna untuk berinteraksi dengan mesin inferensi model.