Le projet llama.cpp a publié la version b11147, qui introduit un nouveau noyau binaire pour OpenCL. Cette mise à jour ajoute spécifiquement le support pour la configuration A8 Q6_K non-MoE dp4a.
- Ajoute un noyau binaire A8 Q6_K non-MoE dp4a pour OpenCL.
- Fournit des binaires pour macOS (Apple Silicon et Intel), iOS, Linux (CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL, Snapdragon), Android, Windows (CPU, Adreno, CUDA, Vulkan, OpenVINO, SYCL, ROCm) et openEuler.
Cette version permet aux utilisateurs d'exécuter llama.cpp sur une large gamme de plateformes matérielles avec les dernières optimisations du noyau.