Proyek llama.cpp telah menambahkan penyetelan vektor perhatian cepat (fa-vec) untuk GPU Apple M4 Pro melalui kontribusi backend Metal baru. Pembaruan ini mengikuti pekerjaan sebelumnya untuk mendukung GPU Apple tambahan dan dihasilkan menggunakan alat `ggml-metal-tuning` pada MacBook Pro 14 inci dari November 2024.

  • Proses penyetelan berjalan sukses dalam 1 jam, 13 menit, dan 1 detik tanpa beban sistem lainnya.
  • Kontribusi ini mendukung tipe data f16 dan q8_0 untuk arsitektur M4 Pro.
  • Rilis ini mencakup biner untuk macOS (Apple Silicon dan Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA, Vulkan, OpenCL, ROCm, OpenVINO, SYCL), dan openEuler.