Le projet llama.cpp a publié la compilation b11067, qui introduit une opération de GDN + copie fusionnée pour le backend WebGPU.
- La version inclut des binaires pour macOS (Apple Silicon et Intel), Linux (Ubuntu avec CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, SYCL), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm 10.0), Android et iOS.
- Le support de KleidiAI pour macOS Apple Silicon est désactivé dans cette compilation.
- Le support d'openEuler est également désactivé.
Cette mise à jour fournit aux utilisateurs des binaires mis à jour sur plusieurs plateformes et accélérateurs, ainsi que l'optimisation spécifique de WebGPU.