أصدر مشروع llama.cpp الإصدار b10165، والذي يستعيد دعم الكمية iq4_nl لخلفية Flash Attention (FA) الخاصة بـ Vulkan. يعالج هذا التغيير المشكلة #23681 من خلال إعادة تمكين الميزة بعد اعتبار مخاوف استخدام الذاكرة المشتركة ضئيلة.
- يضيف دعم iq4_nl مرة أخرى إلى تنفيذ Vulkan FA.
- يضيف دعم q1_0 لتكوينات non-coopmat2.
- يصلح مشكلة GitHub #23681 المتعلقة بإزالة دعم FA q1_0.
يوفر الإصدار ملفات ثنائية لأنظمة macOS و Linux و Windows و Android عبر خلفيات CPU و CUDA و ROCm و OpenVINO و SYCL و Vulkan.