El proyecto llama.cpp ha lanzado la versión b11012, que introduce soporte de Vulkan para las operaciones hc de qwen4exp a través del pull request #28988. Esta actualización también incluye una corrección para un comentario obsoleto.
La publicación proporciona binarios y marcos de trabajo en múltiples plataformas y aceleradores de hardware:
- macOS: Apple Silicon (arm64), Intel (x64) e iOS XCFramework.
- Linux: compilaciones de Ubuntu para CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO y SYCL.
- Windows: compilaciones para CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL y ROCm 10.0.
- Android: soporte de CPU arm64.
Esta publicación permite a los usuarios ejecutar modelos qwen4exp con operaciones de alto cómputo en GPUs compatibles con Vulkan en sistemas operativos compatibles.