Le projet llama.cpp a publié la compilation b10696, qui inclut une demande de tirage ajoutant le réglage rapide des vecteurs (fa-vec) spécifiquement pour la puce Apple M3 Pro.
Cette mise à jour traite le problème #27668 pour améliorer les performances sur cette configuration matérielle spécifique. La version fournit des binaires pour macOS, iOS, Linux, Windows, Android et openEuler via divers backends incluant CPU, CUDA, ROCm, Vulkan, OpenVINO et SYCL.
Le réglage fa-vec est destiné à optimiser la vitesse ou l'efficacité de l'inférence pour les utilisateurs exécutant llama.cpp sur des appareils équipés du processeur M3 Pro.