El proyecto llama.cpp lanzó la compilación b10883, que incluye actualizaciones significativas en el backend de Vulkan. El cambio principal implica el uso de constantes de especificación para operaciones de multiplicación matriz-matriz tipo A para mejorar la compilación y el rendimiento de los shaders.
- Usar constante de especificación para mul mat type_a en shaders de Vulkan.
- Consolidar tablas de memoria compartida y reducir el tamaño mediante la constante de especificación del tipo.
- Restaurar la optimización coopmat2 q4_k/q5_k y separar el shader para corregir la regresión de Ampere.
- Corregir el tipo Q2_0 faltante en la multiplicación de matrices cm2 y adaptar los cambios de ajuste f16 de Intel.
- Solución al error del compilador cm2 mediante el uso de un tamaño mínimo de memoria compartida de 8.
Esta versión proporciona binarios actualizados para macOS, Linux, Windows, Android y openEuler en backends de CPU, GPU y hardware especializado.