أصدر مشروع llama.cpp الإصدار b10517، مقدمًا عدة تحسينات خاصة بـ Vulkan في مسار فك تكميم الانتباه الفلاشي (FA). تشمل التغييرات الرئيسية فك تكميم q8_0 KV مرة واحدة في coopmat1، وتخطي مسار فك تكميم FA على coopmat2، واستبعاد Intel Xe1 من مسار فك تكميم FA.

  • يتحول Vulkan الآن إلى التراجع بدلاً من الإيقاف عند تجاوز مساحة التخزين المؤقت لـ FA لـ maxStorageBufferRange.
  • يتطلب الإصدار تنسيق KV-cache محددًا في مسار فك تكميم FA.
  • تم تشديد فحوصات التبديل لمسار FA وتصحيح توقيت prealloc_x_need_sync.
  • تمت إضافة اختبارات لسيناريوهات K/V FA المخصصة بشكل متجاور.

يعزز هذا التحديث الاستقرار والأداء لمستخدمي Vulkan من خلال معالجة الحالات الحدية في إدارة الذاكرة وتوافق الأجهزة.