El proyecto llama.cpp ha lanzado la versión b10202, introduciendo una optimización SYCL que fusiona las operaciones RMS_NORM y MUL.

Esta actualización proporciona binarios precompilados para macOS (Apple Silicon e Intel), iOS, Linux (Ubuntu x64, arm64, s390x), Windows y Android. Admite varios backends de hardware, incluidos CUDA 12/13, Vulkan, ROCm 7.2, OpenVINO, SYCL FP32/FP16, HIP y OpenCL Adreno.

El lanzamiento también incluye la interfaz de usuario estándar de llama.cpp y señala que el soporte de KleidiAI para macOS Apple Silicon está actualmente deshabilitado.