Le projet llama.cpp a publié la compilation b10688, qui inclut une demande de tirage (pull request) ajoutant des réglages de vecteur rapide (fa-vec) pour l'architecture M2.

Cette mise à jour fournit des binaires et des frameworks sur plusieurs plateformes et configurations matérielles. Les compilations macOS sont disponibles pour Apple Silicon et Intel, tandis que les utilisateurs d'iOS peuvent accéder à un XCFramework. Le support Linux couvre les variantes CPU, Vulkan, ROCm 7.14, OpenVINO et SYCL pour les architectures x64, arm64 et s390x. Les versions Windows incluent le support du CPU, OpenCL Adreno, Vulkan, ROCm 7.14, OpenVINO, SYCL et CUDA 12/13 pour x64 et arm64. Des binaires Android arm64 sont également fournis.

La publication permet aux utilisateurs d'exécuter llama.cpp sur une large gamme de dispositifs et d'accélérateurs en utilisant les derniers artefacts de compilation.