Проект llama.cpp выпустил сборку b11118, которая включает новую функцию hex-dma, внедряющую кэш DMA с прямым отображением, более подходящий для обработки маски HVX FA (Hexagon Vector eXtended).

Этот релиз предоставляет бинарные файлы и фреймворки для нескольких платформ и аппаратных бэкендов:

  • macOS Apple Silicon (arm64), macOS Intel (x64) и iOS XCFramework
  • Linux Ubuntu x64, arm64, s390x и различные GPU/CPU бэкенды, включая CUDA 12/13, ROCm 10.0, OpenVINO, SYCL и Vulkan
  • Windows x64 и arm64 с поддержкой CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL и ROCm 10.0
  • Android arm64 для CPU и Snapdragon (CPU, GPU Adreno, NPU Hexagon)
  • Linux arm64 для устройств Snapdragon, включая CPU, GPU Adreno и NPU Hexagon
  • Также доступна автономная сборка пользовательского интерфейса.

Обновление позволяет пользователям запускать llama.cpp на широком спектре архитектур, особенно улучшая поддержку процессоров Qualcomm Snapdragon с NPU Hexagon благодаря новому кэшу DMA с прямым отображением.