llama.cpp परियोजना ने OpenCL के लिए एक A8 Q8_0 non-MoE dp4a बाइनरी कर्नेल जोड़ा है।

  • यह परिवर्तन ggml-org/llama.cpp रिपॉजिटरी में पुल अनुरोध #29439 के रूप में ट्रैक किया गया है।
  • इसमें OpenCL बैकएंड के भीतर dp4a इन्स्ट्रक्शन सेट का उपयोग करके एक विशिष्ट क्वांटाइज़ेशन फॉर्मेट (A8 Q8_0) के लिए समर्थन पेश किया गया है।