El proyecto llama.cpp lanzó la versión b10442, introduciendo optimizaciones específicas de Vulkan para hardware Intel Xe mientras aborda problemas de seguridad de memoria en rutinas de multiplicación de matrices.
- Añade las banderas SHMEM_STRIDE_PAD y APPLY_SLM_A_RESHAPE para coopmat mul_mm en Intel Xe.
- Corrige la estimación de memoria compartida para Intel SHMEM_STRIDE_PAD=0 en matmul_shmem_support.
- Implementa alineación de línea de caché para kvalues_mxfp4 compartidos para mejorar el manejo de datos.
- Resuelve una lectura fuera de límites (OOB) en la inicialización de kvalues_mxfp4 tras los cambios de relleno de línea de caché.
- Restringe los ajustes de reestructuración SLM-A a controladores de Windows de Intel y revierte el relleno de línea de caché mxfp4 donde sea necesario.
Esta versión proporciona binarios actualizados para macOS, Linux, Windows, Android y openEuler a través de los backends CPU, Vulkan, CUDA, ROCm, OpenVINO y SYCL.