llama.cpp プロジェクトはバージョン b11012 をリリースし、プルリクエスト #28988 を介して qwen4exp hc 演算の Vulkan サポートを導入しました。このアップデートには、古いコメントの修正も含まれています。
今回のリリースでは、複数のプラットフォームとハードウェアアクセラレータ向けにバイナリとフレームワークが提供されています:
- macOS: Apple Silicon (arm64)、Intel (x64)、および iOS XCFramework。
- Linux: CPU、Vulkan、CUDA 12/13、ROCm 10.0、OpenVINO、SYCL 向けの Ubuntu ビルド。
- Windows: CPU、OpenCL Adreno、CUDA 12/13、Vulkan、OpenVINO、SYCL、および ROCm 10.0 向けのビルド。
- Android: arm64 CPU サポート。
このリリースにより、ユーザーは対応するオペレーティングシステム上で Vulkan 互換の GPU で高計算量の演算を行う qwen4exp モデルを実行できるようになります。