Le projet llama.cpp a publié la version b10610, qui inclut une modification pour raccourcir le nommage des appareils virtuels au sein du backend ggml pour les plateformes CUDA et Metal.

  • La mise à jour modifie la façon dont les appareils virtuels sont nommés dans les backends CUDA et Metal afin de réduire la verbosité.
  • Les compilations macOS Apple Silicon avec le support KleidiAI restent désactivées dans cette version.
  • Des binaires sont fournis pour macOS (Apple Silicon et Intel), Linux (CPU, Vulkan, ROCm 7.14, OpenVINO, SYCL), Windows (CPU, CUDA 12/13, Vulkan, OpenCL, ROCm 7.14), Android et openEuler.

Cette version fournit des binaires mis à jour pour divers accélérateurs matériels et systèmes d'exploitation, tout en affinant les chaînes d'identification interne des appareils.