أصدر مشروع llama.cpp الإصدار b10517، مقدمًا عدة تحسينات خاصة بـ Vulkan في مسار فك تكميم الانتباه الفلاشي (FA). تشمل التغييرات الرئيسية فك تكميم q8_0 KV مرة واحدة في coopmat1، وتخطي مسار فك تكميم FA على coopmat2، واستبعاد Intel Xe1 من مسار فك تكميم FA.
- يتحول Vulkan الآن إلى التراجع بدلاً من الإيقاف عند تجاوز مساحة التخزين المؤقت لـ FA لـ maxStorageBufferRange.
- يتطلب الإصدار تنسيق KV-cache محددًا في مسار فك تكميم FA.
- تم تشديد فحوصات التبديل لمسار FA وتصحيح توقيت prealloc_x_need_sync.
- تمت إضافة اختبارات لسيناريوهات K/V FA المخصصة بشكل متجاور.
يعزز هذا التحديث الاستقرار والأداء لمستخدمي Vulkan من خلال معالجة الحالات الحدية في إدارة الذاكرة وتوافق الأجهزة.