Le projet llama.cpp a publié la version b11006, introduisant le support des processeurs Qualcomm Hexagon pour gérer les formats de K-Quantization. Cette mise à jour implémente des noyaux spécifiques pour les niveaux de quantification Q4_K et Q6_K sur l'architecture Hexagon.
- Implémentation des noyaux q6k et q4k pour les DSP Hexagon.
- Précision de dépaquetage améliorée pour le noyau hex-q6k.
- Ajout du support des noyaux Q4_K sur le matériel Hexagon.
La version fournit des binaires préconstruits pour macOS, Linux, Windows, Android et openEuler via divers backends CPU et GPU incluant CUDA, ROCm, Vulkan et OpenVINO.