Proyek llama.cpp telah merilis versi b11424, yang mencakup perbaikan untuk kesalahan penulisan di luar batas memori bersama pada backend Vulkan saat menggunakan Flash Attention.
Pembaruan ini menyediakan biner pra-kompilasi untuk macOS (Apple Silicon dan Intel), Linux (CPU, CUDA, ROCm, OpenVINO, SYCL, Snapdragon), Windows (CPU, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android, dan iOS. Rilis ini juga mencakup antarmuka pengguna llama.cpp.
Pembuatan untuk KleidiAI pada macOS Apple Silicon saat ini dinonaktifkan dalam versi ini.