Le projet llama.cpp a publié la compilation b11067, qui introduit une opération de GDN + copie fusionnée pour le backend WebGPU.

  • La version inclut des binaires pour macOS (Apple Silicon et Intel), Linux (Ubuntu avec CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, SYCL), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm 10.0), Android et iOS.
  • Le support de KleidiAI pour macOS Apple Silicon est désactivé dans cette compilation.
  • Le support d'openEuler est également désactivé.

Cette mise à jour fournit aux utilisateurs des binaires mis à jour sur plusieurs plateformes et accélérateurs, ainsi que l'optimisation spécifique de WebGPU.