Proyek llama.cpp telah merilis versi b11012, yang memperkenalkan dukungan Vulkan untuk operasi hc qwen4exp melalui pull request #28988. Pembaruan ini juga mencakup perbaikan untuk komentar usang.
Rilis ini menyediakan biner dan kerangka kerja di berbagai platform dan akselerator perangkat keras:
- macOS: Apple Silicon (arm64), Intel (x64), dan iOS XCFramework.
- Linux: build Ubuntu untuk CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, dan SYCL.
- Windows: build untuk CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, dan ROCm 10.0.
- Android: dukungan CPU arm64.
Rilis ini memungkinkan pengguna menjalankan model qwen4exp dengan operasi komputasi tinggi pada GPU yang kompatibel dengan Vulkan di sistem operasi yang didukung.