O projeto llama.cpp lançou a versão b10922, introduzindo um novo kernel binário OpenCL para multiplicações de matriz não-MoE de A8 Q4_K. Esta atualização também inclui correções de compatibilidade de layout e renomeia os auxiliares de seleção de kernel binário dentro da base de código.
- Adicionado o kernel OpenCL `kernel_gemm_noshuffle_q4_k_f32_32b_trans_ila_a8_bin`.
- Corrigidos problemas de compatibilidade de layout no backend OpenCL.
- Renomeados os auxiliares de seleção de kernel binário para maior clareza.
Este lançamento fornece binários atualizados para macOS, Linux, Windows, Android e iOS em vários backends de hardware, incluindo CPU, CUDA, Vulkan, ROCm e SYCL.