Proyek llama.cpp telah merilis versi b11122, yang mencakup pembaruan signifikan untuk backend SYCL. Rilis ini memperluas fusi MMVQ GLU untuk mendukung jenis kuantisasi campuran dan memperkenalkan fusi baru untuk operasi rms_norm+scale dan ssm_conv+silu.
- Memperluas fusi MMVQ GLU untuk menangani jenis kuantisasi campuran di backend SYCL.
- Menambahkan fusi rms_norm+scale dan ssm_conv+silu untuk SYCL.
- Memperbaiki masalah spasi dan mengonversi makro menjadi fungsi template.
- Menyediakan biner untuk macOS, Linux, Windows, Android, dan openEuler melalui backend CPU, GPU, dan NPU termasuk CUDA, Vulkan, ROCm, dan OpenVINO.
Pembaruan ini meningkatkan kinerja dan kompatibilitas untuk akselerasi perangkat keras berbasis SYCL dalam ekosistem llama.cpp.