Proyek llama.cpp telah merilis build b11067, yang memperkenalkan operasi GDN + salinan terpadu untuk backend WebGPU.

  • Rilis ini mencakup biner untuk macOS (Apple Silicon dan Intel), Linux (Ubuntu dengan CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, SYCL), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm 10.0), Android, dan iOS.
  • Dukungan KleidiAI untuk macOS Apple Silicon dinonaktifkan dalam build ini.
  • Dukungan openEuler juga dinonaktifkan.

Pembaruan ini menyediakan pengguna dengan biner yang diperbarui di berbagai platform dan akselerator, bersama dengan optimasi WebGPU yang spesifik.