أصدر مشروع llama.cpp الإصدار b10246، والذي يتضمن إصلاحًا لأداء OpenCL في تكوينات نماذج محددة. يعالج التحديث مشكلة كانت فيها شرط البعد الأصلي غير كافٍ للتعامل مع الأوزان الكبيرة.
- يوجّه موترات lm_head q6_K الكبيرة إلى GEMV مسطح بدلاً من gemv_noshuffle.
- يضيف شرط حجم مباشر لمنع التباطؤ مع نماذج مثل gemma-4 E2B، التي لها أبعاد [1536, 262144].
- يوفر ملفات قابلة للتنفيذ لأنظمة macOS (Apple Silicon و Intel)، و Linux (CPU، Vulkan، ROCm، OpenVINO، SYCL)، و Android، و Windows (CPU، CUDA، Vulkan، OpenVINO، SYCL، HIP)، و openEuler.
يضمن هذا التغيير معالجة مصفوفات الأوزان الكبيرة بكفاءة على أجهزة OpenCL دون التسبب في اختناقات في الأداء.