Proyek llama.cpp telah merilis build b10688, yang mencakup permintaan tarik (pull request) yang menambahkan penyetelan vektor cepat (fa-vec) untuk arsitektur M2.

Pembaruan ini menyediakan biner dan kerangka kerja di berbagai platform dan konfigurasi perangkat keras. Build macOS tersedia untuk Apple Silicon dan Intel, sementara pengguna iOS dapat mengakses XCFramework. Dukungan Linux mencakup varian CPU, Vulkan, ROCm 7.14, OpenVINO, dan SYCL untuk arsitektur x64, arm64, dan s390x. Rilis Windows mencakup dukungan CPU, OpenCL Adreno, Vulkan, ROCm 7.14, OpenVINO, SYCL, dan CUDA 12/13 untuk x64 dan arm64. Biner Android arm64 juga disediakan.

Rilis ini memungkinkan pengguna menjalankan llama.cpp di berbagai perangkat dan akselerator menggunakan artefak build terbaru.