O projeto llama.cpp lançou a versão b10442, introduzindo otimizações específicas do Vulkan para hardware da Intel Xe enquanto aborda problemas de segurança de memória em rotinas de multiplicação de matrizes.
- Adiciona as flags SHMEM_STRIDE_PAD e APPLY_SLM_A_RESHAPE para coopmat mul_mm na Intel Xe.
- Corrige a estimativa de memória compartilhada para Intel SHMEM_STRIDE_PAD=0 em matmul_shmem_support.
- Implementa alinhamento de linha de cache para kvalues_mxfp4 compartilhados para melhorar o manuseio de dados.
- Resolve uma leitura fora dos limites (OOB) na inicialização de kvalues_mxfp4 após as alterações de preenchimento da linha de cache.
- Restringe os ajustes de reshaping do SLM-A aos drivers da Intel Windows e reverte o preenchimento da linha de cache mxfp4 quando necessário.
Este lançamento fornece binários atualizados para macOS, Linux, Windows, Android e openEuler através dos backends CPU, Vulkan, CUDA, ROCm, OpenVINO e SYCL.