llama.cpp प्रोजेक्ट ने संस्करण b11006 जारी किया, जिसमें K-Quantization फॉर्मेट्स को संभालने के लिए Qualcomm Hexagon प्रोसेसर के लिए समर्थन पेश किया गया। इस अपडेट में Hexagon आर्किटेक्चर पर Q4_K और Q6_K क्वांटीज़ेशन स्तरों के लिए विशिष्ट kernels लागू किए गए हैं।

  • Hexagon DSPs के लिए q6k और q4k kernels का कार्यान्वयन।
  • hex-q6k kernel के लिए unpack सटीकता में सुधार।
  • Hexagon हार्डवेयर पर Q4_K kernels के लिए समर्थन जोड़ा गया।

रिलीज में CUDA, ROCm, Vulkan और OpenVINO सहित विभिन्न CPU और GPU backends के लिए macOS, Linux, Windows, Android और openEuler के लिए पूर्व-निर्मित बाइनरी प्रदान की गई हैं।