O projeto llama.cpp lançou a compilação b10759, que inclui uma correção para evitar a inicialização do tipo de buffer do KleidiAI no dispatch.
- A versão fornece binários para macOS (Apple Silicon e Intel), iOS, Linux (Ubuntu x64, arm64, s390x), Windows (CPU, CUDA 12/13, Vulkan, OpenCL, ROCm, SYCL, OpenVINO), Android e openEuler.
- O suporte ao KleidiAI está explicitamente desativado para macOS Apple Silicon nesta compilação.
- Pré-visualizações para Windows arm64 com CUDA 13 estão incluídas junto com as versões padrão do CUDA 12.4 e 13.3.