أصدر مشروع llama.cpp الإصدار b11424، والذي يتضمن إصلاحًا لخطأ الكتابة خارج حدود الذاكرة المشتركة في الخلفية (backend) الخاصة بـ Vulkan عند استخدام Flash Attention.
يوفر هذا التحديث ثنائيات جاهزة مسبقًا لأنظمة macOS (Apple Silicon و Intel)، و Linux (CPU، CUDA، ROCm، OpenVINO، SYCL، Snapdragon)، و Windows (CPU، CUDA، Vulkan، OpenVINO، SYCL، ROCm)، و Android، و iOS. يتضمن الإصدار أيضًا واجهة المستخدم الخاصة بـ llama.cpp.
تم تعطيل البناء الخاص بـ KleidiAI على macOS Apple Silicon حاليًا في هذا الإصدار.