El proyecto llama.cpp ha lanzado la versión b11012, que introduce soporte de Vulkan para las operaciones hc de qwen4exp a través del pull request #28988. Esta actualización también incluye una corrección para un comentario obsoleto.

La publicación proporciona binarios y marcos de trabajo en múltiples plataformas y aceleradores de hardware:

  • macOS: Apple Silicon (arm64), Intel (x64) e iOS XCFramework.
  • Linux: compilaciones de Ubuntu para CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO y SYCL.
  • Windows: compilaciones para CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL y ROCm 10.0.
  • Android: soporte de CPU arm64.

Esta publicación permite a los usuarios ejecutar modelos qwen4exp con operaciones de alto cómputo en GPUs compatibles con Vulkan en sistemas operativos compatibles.