Proyek llama.cpp merilis build b10754, yang mencakup perbaikan kritis untuk OpenCL pada GPU Adreno untuk mencegah pembacaan memori di luar batas pada kernel pemrosesan gambar.

  • Pengambilan baris decode q4_K GEMV sekarang dibatasi pada grid x yang dipad.
  • Kontrak tiling untuk GEMM KQ/KQV gambar ditegakkan secara ketat.
  • Logika split untuk gambar KQ/KQV ditentukan saat dispatch, bukan bergantung pada strides.

Pembaruan ini memastikan stabilitas dan kebenaran bagi pengguna yang menjalankan llama.cpp dengan akselerasi OpenCL pada perangkat keras Adreno.