أصدر مشروع llama.cpp الإصدار b10781، الذي يتضمن إصلاحًا لمسار فك تكميم الانتباه السريع (FA) الخاص بـ Vulkan. يعالج التحديث مشكلة حيث كان الشادر يتحقق بشكل غير صحيح من `nb[3]` حتى عندما يكون `ne[3] == 1`، مما يؤدي إلى تفعيل المسار فقط عندما تكون ذاكرة التخزين المؤقت ممتلئة.
- يتخطى التحقق من `nb[3]` عندما يكون `ne[3] == 1` لأن الشادر لا يقرأه أبدًا لتيار واحد.
- يحل خطأً في المنطق حيث كانت مشاهدات ذاكرة التخزين المؤقت تحمل خطوة المخزن الكامل، مما قلل التحقق القديم إلى `n_kv == kv_size`.
- يوفر ثنائيات (binaries) لنظام macOS (شريحة Apple Silicon وIntel)، وiOS، وLinux (CPU، Vulkan، ROCm، OpenVINO، SYCL)، وAndroid، وWindows (CPU، CUDA 12/13، Vulkan، OpenVINO، SYCL، ROCm)، وopenEuler.
يضمن هذا الإصلاح تفعيل مسار فك تكميم الانتباه السريع عبر Vulkan بشكل صحيح أثناء الاستدلال بدلاً من تقييده بحالات ذاكرة التخزين المؤقت الممتلئة.