Proyek llama.cpp telah merilis versi b11012, yang memperkenalkan dukungan Vulkan untuk operasi hc qwen4exp melalui pull request #28988. Pembaruan ini juga mencakup perbaikan untuk komentar usang.

Rilis ini menyediakan biner dan kerangka kerja di berbagai platform dan akselerator perangkat keras:

  • macOS: Apple Silicon (arm64), Intel (x64), dan iOS XCFramework.
  • Linux: build Ubuntu untuk CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, dan SYCL.
  • Windows: build untuk CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, dan ROCm 10.0.
  • Android: dukungan CPU arm64.

Rilis ini memungkinkan pengguna menjalankan model qwen4exp dengan operasi komputasi tinggi pada GPU yang kompatibel dengan Vulkan di sistem operasi yang didukung.