Проект llama.cpp выпустил версию b10442, внедряя специфические оптимизации Vulkan для оборудования Intel Xe, одновременно решая проблемы безопасности памяти в routines умножения матриц.
- Добавлены флаги SHMEM_STRIDE_PAD и APPLY_SLM_A_RESHAPE для coopmat mul_mm на Intel Xe.
- Исправлена оценка разделяемой памяти для Intel SHMEM_STRIDE_PAD=0 в matmul_shmem_support.
- Реализовано выравнивание кэш-линий для общих kvalues_mxfp4 для улучшения обработки данных.
- Устранено чтение за пределами массива (OOB) при инициализации kvalues_mxfp4 после изменений с заполнением кэш-линий.
- Ограничены корректировки перестройки SLM-A драйверами Intel Windows, а там, где необходимо, откатывается заполнение кэш-линий mxfp4.
Этот релиз предоставляет обновленные бинарные файлы для macOS, Linux, Windows, Android и openEuler для бэкендов CPU, Vulkan, CUDA, ROCm, OpenVINO и SYCL.