Proyek llama.cpp merilis versi b11006, memperkenalkan dukungan untuk prosesor Qualcomm Hexagon guna menangani format K-Quantization. Pembaruan ini mengimplementasikan kernel spesifik untuk tingkat kuantisasi Q4_K dan Q6_K pada arsitektur Hexagon.

  • Implementasi kernel q6k dan q4k untuk DSP Hexagon.
  • Akurasi unpacking yang lebih baik untuk kernel hex-q6k.
  • Ditambahkan dukungan untuk kernel Q4_K pada perangkat keras Hexagon.

Rilis ini menyediakan binaris pra-bangun untuk macOS, Linux, Windows, Android, dan openEuler di berbagai backend CPU dan GPU termasuk CUDA, ROCm, Vulkan, dan OpenVINO.