Proyek llama.cpp merilis versi b10442, memperkenalkan optimasi Vulkan spesifik untuk perangkat keras Intel Xe sambil mengatasi masalah keamanan memori dalam rutinitas perkalian matriks.
- Menambahkan flag SHMEM_STRIDE_PAD dan APPLY_SLM_A_RESHAPE untuk coopmat mul_mm pada Intel Xe.
- Memperbaiki estimasi memori bersama untuk Intel SHMEM_STRIDE_PAD=0 di matmul_shmem_support.
- Mengimplementasikan penjajaran baris cache untuk kvalues_mxfp4 bersama guna meningkatkan penanganan data.
- Menyelesaikan bacaan di luar batas (OOB) dalam inisialisasi kvalues_mxfp4 setelah perubahan padding baris cache.
- Membatasi penyesuaian reshaping SLM-A ke driver Windows Intel dan membatalkan padding baris cache mxfp4 jika diperlukan.
Rilis ini menyediakan biner yang diperbarui untuk macOS, Linux, Windows, Android, dan openEuler melalui backend CPU, Vulkan, CUDA, ROCm, OpenVINO, dan SYCL.