llama.cpp प्रोजेक्ट ने संस्करण b11160 जारी किया, जिसने AMD RDNA3 और RDNA4 आर्किटेक्चर पर Vulkan के लिए int8 सहयोगी मैट्रिक्स (coopmat1) कार्यान्वयन पेश किया। इस अपडेट में एक समर्पित शेडर शामिल है जो प्रदर्शन को बेहतर बनाने के लिए coopmat मानों को सीधे प्रोब करता है।

  • mul_mmq_cm1 पूर्णांक matmul शेडर में IQ4_XS क्वांटीज़ेशन समर्थन जोड़ा गया।
  • Vulkan बैकएंड के लिए इनलाइन स्केल अनुप्रयोग, अदिश योग और डबल बफरिंग लागू किया गया।
  • q8_0, q4_1, q5_0, q5_1, iq4_nl, mxfp4, q3_k, q4_k, q5_k, q6_k, और nvfp4 क्वांटीज़ेशन का समर्थन करता है।
  • CPU, CUDA, ROCm, OpenVINO, और SYCL बैकएंड के लिए macOS, Linux, Windows, Android, और openEuler के लिए बाइनरी शामिल हैं।