أصدر مشروع llama.cpp الإصدار b10813، الذي يقدم تنفيذًا لـ OpenCL لوحات GPU من نوع Adreno باستخدام مسار xmem SDPA (Scaled Dot-Product Attention). يعالج هذا التحديث أيضًا الأخطاء العددية في آليات GVA والانتباه المقنع.

  • تمت إضافة مسار Adreno xmem SDPA لتسريع OpenCL.
  • تم تجاوز تعريف ملف التعريف المحدد لـ Adreno.
  • تم تصحيح الأخطاء العددية في GQA والانتباه المقنع.
  • تم إدخال متغير البيئة GGML_OPENCL_XMEM_SDPA للتحكم في الميزة.

يوفر الإصدار ملفات ثنائية لنظام macOS وLinux وWindows وAndroid وopenEuler عبر backends المعالج ووحدة معالجة الرسومات والأجهزة المتخصصة.