Proyek llama.cpp telah merilis versi b10202, memperkenalkan optimasi SYCL yang menyatukan operasi RMS_NORM dan MUL.
Pembaruan ini menyediakan binaris pra-bangun untuk macOS (Apple Silicon dan Intel), iOS, Linux (Ubuntu x64, arm64, s390x), Windows, dan Android. Ini mendukung berbagai backend perangkat keras termasuk CUDA 12/13, Vulkan, ROCm 7.2, OpenVINO, SYCL FP32/FP16, HIP, dan OpenCL Adreno.
Rilis ini juga mencakup UI standar llama.cpp dan mencatat bahwa dukungan KleidiAI untuk macOS Apple Silicon saat ini dinonaktifkan.