أصدر مشروع llama.cpp الإصدار b10702، والذي يتضمن تحسينًا محددًا لمسار الضرب النقطي للتكميم Q2_0 على بنية gfx1201 من AMD. يوسع هذا التحديث تنفيذ HIP لاستخدام تعليمات التبديل amdgcn الأصلية، مما يحسن الأداء لهذا التكوين المحدد للأجهزة.

  • يُحسّن `vec_dot_q2_0_q8_1` باستخدام تبديل amdgcn الأصلي لـ gfx1201.
  • يوسع تحسين تبديل Q2_0 في HIP ويزيل حواجز التوفر الزائدة عن الحاجة.
  • يُحسّن فك ضغط MMQ Q2_0 في HIP باستخدام تعليمات التبديل الأصلية.
  • يستعيد معالجة فهرس البلاطة MMQ ويعلّم حواجز المعالج المسبق HIP في كود CUDA.

يوفر هذا الإصدار ملفات ثنائية لأنظمة macOS و Linux و Windows و Android و openEuler عبر وحدات المعالجة المركزية، ووحدات معالجة الرسومات (CUDA، ROCm، Vulkan، OpenCL)، والخوادم الخلفية المتخصصة مثل OpenVINO و SYCL.