El proyecto llama.cpp ha lanzado la compilación b11118, que incluye una nueva función hex-dma que introduce un caché DMA de mapeo directo mejor adaptado para el manejo de máscaras FA de Hexagon Vector eXtended (HVX).

Esta versión proporciona binarios y marcos de trabajo en múltiples plataformas y backends de hardware:

  • macOS Apple Silicon (arm64), macOS Intel (x64) y XCFramework para iOS
  • Linux Ubuntu x64, arm64, s390x y varios backends de GPU/CPU que incluyen CUDA 12/13, ROCm 10.0, OpenVINO, SYCL y Vulkan
  • Windows x64 y arm64 con soporte para CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL y ROCm 10.0
  • Android arm64 para CPU y Snapdragon (CPU, GPU Adreno, NPU Hexagon)
  • Linux arm64 para dispositivos Snapdragon que incluyen CPU, GPU Adreno y NPU Hexagon
  • También está disponible una compilación de interfaz de usuario independiente.

La actualización permite a los usuarios ejecutar llama.cpp en una amplia gama de arquitecturas, mejorando particularmente el soporte para procesadores Qualcomm Snapdragon con NPUs Hexagon a través del nuevo caché DMA de mapeo directo.