Rilis llama.cpp b10814 memperluas dukungan backend OpenCL dengan menambahkan sembilan operasi unary elementwise baru dan meningkatkan kernel pergerakan data.
- Menambahkan operasi unary elementwise yang diperluas termasuk sgn, step, elu, hardswish, hardsigmoid, floor, ceil, round, dan trunc untuk mencegah fallback CPU.
- Mengimplementasikan kernel salinan f32 kontigu yang didispatch ke seluruh perangkat untuk pergerakan linear, mengoptimalkan kinerja untuk tensor dengan sedikit baris panjang.
- Memperluas dukungan CONCAT ke semua tipe yang mudah disalin (f16, bf16, i8, i16, i32, i64) dengan mengunci kernel pada ukuran elemen bukan tipe spesifik.
Perubahan ini meningkatkan cakupan dan efisiensi OpenCL untuk backend non-CPU di macOS, Linux, Windows, dan Android.