llama.cpp प्रोजेक्ट ने संस्करण b10657 जारी किया, जिसमें मिश्रित-विशेषज्ञ मॉडलों के लिए नए ओपनसीएल बाइनरी कर्नेल्स पेश किए गए हैं। विशेष रूप से, अपडेट में संगत हार्डवेयर पर कुशल गणना का समर्थन करने के लिए `kernel_gemm_moe_q4_0_q8_1_dp4a_bin` और `kernel_gemm_moe_mxfp4_q8_1_dp4a_bin` जोड़े गए हैं।

  • q4_0/q8_1 और mxfp4/q8_1 क्वांटीकरण के साथ GEMO MOE के लिए ओपनसीएल बाइनरी कर्नेल्स जोड़े गए।
  • macOS (Apple Silicon और Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), Android और openEuler के लिए बाइनरी प्रदान किए गए।
  • इस रिलीज़ में macOS Apple Silicon पर KleidiAI समर्थन अक्षम बना हुआ है।

विशिष्ट ओपनसीएल कर्नेल कार्यान्वयनों को सक्षम करके यह अपडेट मिश्रित-विशेषज्ञ मॉडलों के लिए हार्डवेयर संगतता का विस्तार करता है।