El proyecto llama.cpp ha lanzado la compilación b11118, que incluye una nueva función hex-dma que introduce un caché DMA de mapeo directo mejor adaptado para el manejo de máscaras FA de Hexagon Vector eXtended (HVX).
Esta versión proporciona binarios y marcos de trabajo en múltiples plataformas y backends de hardware:
- macOS Apple Silicon (arm64), macOS Intel (x64) y XCFramework para iOS
- Linux Ubuntu x64, arm64, s390x y varios backends de GPU/CPU que incluyen CUDA 12/13, ROCm 10.0, OpenVINO, SYCL y Vulkan
- Windows x64 y arm64 con soporte para CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL y ROCm 10.0
- Android arm64 para CPU y Snapdragon (CPU, GPU Adreno, NPU Hexagon)
- Linux arm64 para dispositivos Snapdragon que incluyen CPU, GPU Adreno y NPU Hexagon
- También está disponible una compilación de interfaz de usuario independiente.
La actualización permite a los usuarios ejecutar llama.cpp en una amplia gama de arquitecturas, mejorando particularmente el soporte para procesadores Qualcomm Snapdragon con NPUs Hexagon a través del nuevo caché DMA de mapeo directo.