llama.cpp प्रोजेक्ट ने संस्करण b11424 जारी किया है, जिसमें Flash Attention का उपयोग करते समय Vulkan बैकएंड में शेयरड मेमोरी के बाउंड्स से बाहर लिखने की त्रुटि के लिए एक ठीक शामिल है।

इस अपडेट में macOS (Apple Silicon और Intel), Linux (CPU, CUDA, ROCm, OpenVINO, SYCL, Snapdragon), Windows (CPU, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android, और iOS के लिए प्रीकंपाइंड बाइनरी शामिल हैं। रिलीज में llama.cpp UI भी शामिल है।

इस संस्करण में macOS Apple Silicon पर KleidiAI के लिए बिल्ड वर्तमान में अक्षम है।