Le projet llama.cpp a publié la compilation b10706, introduisant de nouvelles fonctionnalités dans le backend ggml. Cette mise à jour inclut l'ajout de SWIGLU_CLAMP et une nouvelle implémentation du shader Vulkan.

  • ggml : ajouter SWIGLU_CLAMP
  • ajouter un shader vulkan

Cette version fournit des binaires précompilés pour macOS, Linux, Windows, Android et openEuler sur divers backends matériels incluant CPU, CUDA, ROCm, OpenVINO, SYCL et OpenCL.