Proyek llama.cpp merilis build b10754, yang mencakup perbaikan kritis untuk OpenCL pada GPU Adreno untuk mencegah pembacaan memori di luar batas pada kernel pemrosesan gambar.
- Pengambilan baris decode q4_K GEMV sekarang dibatasi pada grid x yang dipad.
- Kontrak tiling untuk GEMM KQ/KQV gambar ditegakkan secara ketat.
- Logika split untuk gambar KQ/KQV ditentukan saat dispatch, bukan bergantung pada strides.
Pembaruan ini memastikan stabilitas dan kebenaran bagi pengguna yang menjalankan llama.cpp dengan akselerasi OpenCL pada perangkat keras Adreno.