Proyek llama.cpp merilis versi b11006, memperkenalkan dukungan untuk prosesor Qualcomm Hexagon guna menangani format K-Quantization. Pembaruan ini mengimplementasikan kernel spesifik untuk tingkat kuantisasi Q4_K dan Q6_K pada arsitektur Hexagon.
- Implementasi kernel q6k dan q4k untuk DSP Hexagon.
- Akurasi unpacking yang lebih baik untuk kernel hex-q6k.
- Ditambahkan dukungan untuk kernel Q4_K pada perangkat keras Hexagon.
Rilis ini menyediakan binaris pra-bangun untuk macOS, Linux, Windows, Android, dan openEuler di berbagai backend CPU dan GPU termasuk CUDA, ROCm, Vulkan, dan OpenVINO.