Proyek llama.cpp telah merilis build b11382, yang mencakup pembaruan kunci untuk backend WebGPU-nya. Rilis ini menambahkan dukungan floating-point 16-bit (f16) secara khusus untuk operasi `fill` dan `set_rows` di dalam implementasi WebGPU.

  • Perubahan kode sumber dilacak di pull request #29897 pada repositori ggml-org/llama.cpp.
  • Binari disediakan untuk macOS (Apple Silicon dan Intel), iOS, Linux (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL, Snapdragon), Windows (CPU, OpenCL, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android, dan openEuler.
  • Rilis ini juga mencakup binari UI standar llama.cpp.