أصدر مشروع llama.cpp الإصدار b10781، الذي يتضمن إصلاحًا لمسار فك تكميم الانتباه السريع (FA) الخاص بـ Vulkan. يعالج التحديث مشكلة حيث كان الشادر يتحقق بشكل غير صحيح من `nb[3]` حتى عندما يكون `ne[3] == 1`، مما يؤدي إلى تفعيل المسار فقط عندما تكون ذاكرة التخزين المؤقت ممتلئة.

  • يتخطى التحقق من `nb[3]` عندما يكون `ne[3] == 1` لأن الشادر لا يقرأه أبدًا لتيار واحد.
  • يحل خطأً في المنطق حيث كانت مشاهدات ذاكرة التخزين المؤقت تحمل خطوة المخزن الكامل، مما قلل التحقق القديم إلى `n_kv == kv_size`.
  • يوفر ثنائيات (binaries) لنظام macOS (شريحة Apple Silicon وIntel)، وiOS، وLinux (CPU، Vulkan، ROCm، OpenVINO، SYCL)، وAndroid، وWindows (CPU، CUDA 12/13، Vulkan، OpenVINO، SYCL، ROCm)، وopenEuler.

يضمن هذا الإصلاح تفعيل مسار فك تكميم الانتباه السريع عبر Vulkan بشكل صحيح أثناء الاستدلال بدلاً من تقييده بحالات ذاكرة التخزين المؤقت الممتلئة.