llama.cpp 프로젝트는 RMS_NORM 및 MUL 연산을 융합하는 SYCL 최적화를 도입한 버전 b10202를 출시했습니다.
이 업데이트에서는 macOS (Apple Silicon 및 Intel), iOS, Linux (Ubuntu x64, arm64, s390x), Windows 및 Android용 사전 빌드된 바이너리를 제공합니다. CUDA 12/13, Vulkan, ROCm 7.2, OpenVINO, SYCL FP32/FP16, HIP 및 OpenCL Adreno를 포함한 다양한 하드웨어 백엔드를 지원합니다.
릴리스에는 표준 llama.cpp UI도 포함되어 있으며, macOS Apple Silicon에 대한 KleidiAI 지원은 현재 비활성화되어 있습니다.