llama.cpp प्रोजेक्ट ने संस्करण b10997 जारी किया, जिसमें Mixture of Experts (MoE) ncols_opt टाइल हीयूरिस्टिक में RDNA3.5 आर्किटेक्चर का समर्थन करने के लिए एक बदलाव शामिल है।

  • ggml/src/ggml-cuda/mmq.cu में कोड को अपडेट किया गया है ताकि शर्त जांच में RDNA3.5 शामिल हो सके।
  • AMD Radeon 8060S पर प्रदर्शन परीक्षणों ने LFM2.5-8B-A1B-UD-Q4_K_M के लिए +16.198% और Qwen1.5-MoE-A2.7B-Q2_K के लिए +6.189% की गति वृद्धि दिखाई।
  • रिलीज में CPU, CUDA, ROCm, Vulkan, OpenVINO और SYCL बैकएंड्स के लिए macOS, Linux, Windows, Android और openEuler के लिए बाइनरी प्रदान करता है।