Проект llama.cpp выпустил версию b11012, которая внедряет поддержку Vulkan для операций qwen4exp hc через запрос на слияние #28988. Это обновление также включает исправление устаревшего комментария.
Релиз предоставляет бинарные файлы и фреймворки для нескольких платформ и аппаратных ускорителей:
- macOS: Apple Silicon (arm64), Intel (x64) и iOS XCFramework.
- Linux: сборки Ubuntu для CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO и SYCL.
- Windows: сборки для CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL и ROCm 10.0.
- Android: поддержка arm64 CPU.
Это обновление позволяет пользователям запускать модели qwen4exp с операциями высокой вычислительной нагрузки на GPU, совместимых с Vulkan, в поддерживаемых операционных системах.