أصدر مشروع llama.cpp الإصدار b10813، الذي يقدم تنفيذًا لـ OpenCL لوحات GPU من نوع Adreno باستخدام مسار xmem SDPA (Scaled Dot-Product Attention). يعالج هذا التحديث أيضًا الأخطاء العددية في آليات GVA والانتباه المقنع.
- تمت إضافة مسار Adreno xmem SDPA لتسريع OpenCL.
- تم تجاوز تعريف ملف التعريف المحدد لـ Adreno.
- تم تصحيح الأخطاء العددية في GQA والانتباه المقنع.
- تم إدخال متغير البيئة GGML_OPENCL_XMEM_SDPA للتحكم في الميزة.
يوفر الإصدار ملفات ثنائية لنظام macOS وLinux وWindows وAndroid وopenEuler عبر backends المعالج ووحدة معالجة الرسومات والأجهزة المتخصصة.