Proyek llama.cpp telah merilis versi b10738, menyediakan biner untuk macOS, Linux, Windows, Android, dan openEuler di CPU, GPU, dan berbagai backend akselerator.

  • Rilis ini mencakup pembaruan spesifik untuk dukungan SYCL yang membatasi memori alokasi maksimum menjadi 2GB untuk memori host-pinned.
  • Build macOS Apple Silicon dengan KleidiAI dinonaktifkan dalam versi ini.
  • Dukungan preview untuk CUDA 13 di Windows arm64 disertakan.
  • Biner ROCm 7.14 dan OpenVINO 2026.3.1 tersedia untuk Ubuntu dan Windows.

Pembaruan ini memungkinkan pengguna mengakses fungsionalitas terbaru llama.cpp pada perangkat keras yang didukung, dengan perhatian khusus pada batasan memori dalam implementasi SYCL.