Proyek llama.cpp merilis versi b10795, yang mencakup optimasi baru untuk backend SYCL. Pembaruan ini mengaktifkan penggabungan rantai RMS_NORM+MUL+ADD dan ADD+ADD residual di bawah flag GGML_SYCL_ENABLE_FUSION.
- Operasi ADD+ADD yang digabungkan menggunakan kembali indeks broadcast dan matriks tipe yang sama dengan fungsi add() mandiri, mendukung f32, f16, i32, i16, bf16, dan data non-kontigu.
- Kombinasi yang tidak didukung dalam logika penggabungan kembali ke dua peluncuran add() terpisah untuk menjaga kompatibilitas.
Rilis ini menyediakan biner untuk macOS, Linux, Windows, Android, dan openEuler di berbagai akselerator perangkat keras, termasuk CUDA, ROCm, Vulkan, dan OpenVINO.