أصدر مشروع llama.cpp الإصدار b10246، والذي يتضمن إصلاحًا لأداء OpenCL في تكوينات نماذج محددة. يعالج التحديث مشكلة كانت فيها شرط البعد الأصلي غير كافٍ للتعامل مع الأوزان الكبيرة.

  • يوجّه موترات lm_head q6_K الكبيرة إلى GEMV مسطح بدلاً من gemv_noshuffle.
  • يضيف شرط حجم مباشر لمنع التباطؤ مع نماذج مثل gemma-4 E2B، التي لها أبعاد [1536, 262144].
  • يوفر ملفات قابلة للتنفيذ لأنظمة macOS (Apple Silicon و Intel)، و Linux (CPU، Vulkan، ROCm، OpenVINO، SYCL)، و Android، و Windows (CPU، CUDA، Vulkan، OpenVINO، SYCL، HIP)، و openEuler.

يضمن هذا التغيير معالجة مصفوفات الأوزان الكبيرة بكفاءة على أجهزة OpenCL دون التسبب في اختناقات في الأداء.