Проект llama.cpp выпустил сборку b11118, которая включает новую функцию hex-dma, внедряющую кэш DMA с прямым отображением, более подходящий для обработки маски HVX FA (Hexagon Vector eXtended).
Этот релиз предоставляет бинарные файлы и фреймворки для нескольких платформ и аппаратных бэкендов:
- macOS Apple Silicon (arm64), macOS Intel (x64) и iOS XCFramework
- Linux Ubuntu x64, arm64, s390x и различные GPU/CPU бэкенды, включая CUDA 12/13, ROCm 10.0, OpenVINO, SYCL и Vulkan
- Windows x64 и arm64 с поддержкой CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL и ROCm 10.0
- Android arm64 для CPU и Snapdragon (CPU, GPU Adreno, NPU Hexagon)
- Linux arm64 для устройств Snapdragon, включая CPU, GPU Adreno и NPU Hexagon
- Также доступна автономная сборка пользовательского интерфейса.
Обновление позволяет пользователям запускать llama.cpp на широком спектре архитектур, особенно улучшая поддержку процессоров Qualcomm Snapdragon с NPU Hexagon благодаря новому кэшу DMA с прямым отображением.