llama.cpp 프로젝트가 버전 b11424를 출시했으며, 여기에는 Flash Attention 사용 시 Vulkan 백엔드에서 공유 메모리 경계 밖 쓰기가 발생하는 오류에 대한 수정이 포함되어 있습니다.
이 업데이트에서는 macOS(Apple Silicon 및 Intel), Linux(CPU, CUDA, ROCm, OpenVINO, SYCL, Snapdragon), Windows(CPU, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android 및 iOS용 사전 컴파일된 바이너리를 제공합니다. 릴리스에는 llama.cpp UI도 포함되어 있습니다.
이 버전에서는 macOS Apple Silicon에 대한 KleidiAI 빌드가 현재 비활성화되어 있습니다.