Проект llama.cpp выпустил версию b11012, которая внедряет поддержку Vulkan для операций qwen4exp hc через запрос на слияние #28988. Это обновление также включает исправление устаревшего комментария.

Релиз предоставляет бинарные файлы и фреймворки для нескольких платформ и аппаратных ускорителей:

  • macOS: Apple Silicon (arm64), Intel (x64) и iOS XCFramework.
  • Linux: сборки Ubuntu для CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO и SYCL.
  • Windows: сборки для CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL и ROCm 10.0.
  • Android: поддержка arm64 CPU.

Это обновление позволяет пользователям запускать модели qwen4exp с операциями высокой вычислительной нагрузки на GPU, совместимых с Vulkan, в поддерживаемых операционных системах.