llama.cpp 프로젝트는 pull request #28988을 통해 qwen4exp hc 연산에 대한 Vulkan 지원을 도입한 버전 b11012를 출시했습니다. 이 업데이트에는 오래된 주석 수정도 포함되어 있습니다.

이번 릴리스는 여러 플랫폼과 하드웨어 가속기에서 바이너리와 프레임워크를 제공합니다:

  • macOS: Apple Silicon (arm64), Intel (x64) 및 iOS XCFramework.
  • Linux: CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, SYCL용 Ubuntu 빌드.
  • Windows: CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL 및 ROCm 10.0용 빌드.
  • Android: arm64 CPU 지원.

이 릴리스는 사용자가 지원되는 운영 체제에서 Vulkan 호환 GPU로 고연산 qwen4exp 모델을 실행할 수 있도록 합니다.