llama.cpp 프로젝트는 mul_mm coopmat1 경로에서 불필요한 Mixture of Experts (MoE) 작업을 건너뛰기 위한 Vulkan 최적화를 포함한 빌드 b11017을 출시했습니다.
이 업데이트에는 macOS (Apple Silicon 및 Intel), Linux (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), Android 및 openEuler용 사전 빌드 바이너리가 제공됩니다.
릴리스에는 llama.cpp UI도 포함되어 있습니다.