Proyek llama.cpp merilis build b11207, yang memperkenalkan dukungan untuk operasi GET_ROWS bertiling Q4_0 dan Q8_0 pada backend Hexagon. Pembaruan ini juga mencakup perbaikan pada makro, tumpahan register, dan pipeline DMA, bersama dengan peningkatan logika pemilihan kernel dan vektorisasi yang diaktifkan kembali.
- Menambahkan dukungan GET_ROWS bertiling Q4_0 dan Q8_0 untuk Hexagon menggunakan dequantisasi HVX bertiling.
- Memperbaiki makro dan tumpahan register dalam hex-get-rows saat membersihkan pemeriksaan operasi yang tidak didukung.
- Meningkatkan pipeline DMA dan menyederhanakan logika pemilihan kernel.
- Mengaktifkan kembali vectorizer setelah regresi diidentifikasi selama pembaruan sampler.
Rilis ini menyediakan biner untuk macOS, Linux, Windows, Android, dan openEuler di berbagai backend perangkat keras termasuk CPU, GPU, NPU, CUDA, ROCm, Vulkan, OpenVINO, dan SYCL.