أصدر مشروع llama.cpp الإصدار b10427، الذي يتضمن تحسينًا للأداء لوحات Intel Arc الرسومية عبر SYCL. يطبق التحديث دمج عمليات gate و up و GLU داخل طبقة الشبكة العصبية الأمامية الكثيفة (FFN) من نوع q4_K.

  • تم القياس على جهاز Arc Pro B70 باستخدام llama-bench، وزاد الإنتاجية بنسبة 2.8% لنموذج qwen2.5-3B-Instruct و 2.0% لنموذج gemma-2-2b-it.
  • أظهرت اختبارات الاستدلال الدفعي (batched inference) على نموذج qwen2.5-3B مكاسب كبيرة: +3.4% عند حجم دفعي 1، وترتفع إلى +10.1% عند B=2، و+10.7% عند B=4، و+12.4% عند B=8.

يوفر هذا الإصدار ملفات ثنائية جاهزة للتشغيل لأنظمة macOS و Linux و Windows و Android و openEuler عبر الخلفيات CPU و CUDA و Vulkan و ROCm و OpenVINO.