Proyek llama.cpp merilis versi b10670, yang mencakup optimasi khusus untuk arsitektur Xe2 Intel. Pembaruan ini mengarahkan operasi decode kunci-nilai (KV) terkuantisasi secara eksklusif ke backend TILE untuk perangkat keras BMG, sambil mempertahankan backend VEC pada arsitektur lain hingga divalidasi.

  • Decode KV terkuantisasi sekarang diarahkan ke TILE pada Xe2 (BMG).
  • Arsitektur lain terus menggunakan backend VEC menunggu validasi.
  • Binari disediakan untuk macOS (Apple Silicon dan Intel), Linux (CPU, Vulkan, ROCm 7.14, OpenVINO, SYCL FP32/FP16), Android, Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm 7.14), dan openEuler.

Perubahan ini mengoptimalkan pola akses memori untuk generasi perangkat keras Intel tertentu.