Proyek llama.cpp telah merilis versi b10816, yang mencakup pembaruan pada backend Metal untuk perangkat Apple Silicon. Rilis ini berfokus pada penambahan penyetelan fast-vector yang tersisa secara khusus untuk arsitektur chip M3.

  • Menambahkan entri M3 ke fa_vec_tuned_table.
  • Termasuk kuantisasi q4_0, q4_1, q5_0, dan q5_1 dalam ggml-metal-tuning.
  • Menyediakan biner untuk macOS (Apple Silicon dan Intel), iOS, Linux, Windows, Android, dan openEuler.
  • Mendukung berbagai backend termasuk CPU, Vulkan, ROCm 10.0, OpenVINO, SYCL, CUDA 12/13, dan OpenCL Adreno.

Pembaruan ini memastikan kinerja yang dioptimalkan untuk perangkat keras M3 sambil memperluas ketersediaan biner pra-bangun di berbagai sistem operasi dan arsitektur GPU.