llama.cpp 프로젝트는 GLM-4.7-Flash 모델에 대한 멀티 토큰 예측(MTP) 지원을 도입한 빌드 b10251을 출시했습니다.
이 릴리스에는 macOS(Apple Silicon 및 Intel), iOS, Linux(Ubuntu x64, arm64, s390x, CPU, Vulkan, ROCm 7.2, OpenVINO, SYCL 백엔드 포함), Android(arm64), Windows(CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, HIP), openEuler(ACL Graph)용 바이너리가 포함되어 있습니다.
이 버전에서는 macOS Apple Silicon KleidiAI 빌드가 비활성화되었습니다.