Проект llama.cpp выпустил версию b10816, которая включает обновления бэкенда Metal для устройств на базе Apple Silicon. Выпуск сосредоточен на добавлении оставшихся настроек fast-vector специально для архитектуры чипа M3.
- Добавлены записи M3 в таблицу fa_vec_tuned_table.
- Включены квантования q4_0, q4_1, q5_0 и q5_1 в ggml-metal-tuning.
- Предоставлены бинарники для macOS (Apple Silicon и Intel), iOS, Linux, Windows, Android и openEuler.
- Поддерживаются различные бэкенды, включая CPU, Vulkan, ROCm 10.0, OpenVINO, SYCL, CUDA 12/13 и OpenCL Adreno.
Это обновление обеспечивает оптимизированную производительность для оборудования M3, а также расширяет доступность предварительно собранных бинарников на нескольких операционных системах и архитектурах GPU.