Le projet llama.cpp a publié la compilation b10576, qui réajoute les noyaux MMVQ réordonnés Q2_K et ESIMD pour le support de SYCL. Ce changement annule effectivement un commit précédent qui avait supprimé ces implémentations spécifiques de noyaux.
- La version inclut des binaires pour macOS (Apple Silicon et Intel), Linux (Ubuntu x64, arm64, s390x), Windows et Android.
- L'accélération GPU est prise en charge via Vulkan, ROCm 7.14, OpenVINO, CUDA 12/13 et SYCL sur plusieurs plateformes.
- Le support macOS KleidiAI reste désactivé dans cette compilation.
Cette mise à jour restaure des noyaux de quantification spécifiques pour les appareils SYCL tout en fournissant des binaires complets pour divers systèmes d'exploitation et accélérateurs matériels.