Proyek llama.cpp telah merilis build b11118, yang mencakup fitur hex-dma baru yang memperkenalkan direktori DMA terpetakan langsung lebih cocok untuk penanganan mask FA Hexagon Vector eXtended (HVX).
Rilis ini menyediakan biner dan kerangka kerja di berbagai platform dan backend perangkat keras:
- macOS Apple Silicon (arm64), macOS Intel (x64), dan iOS XCFramework
- Linux Ubuntu x64, arm64, s390x, dan berbagai backend GPU/CPU termasuk CUDA 12/13, ROCm 10.0, OpenVINO, SYCL, dan Vulkan
- Windows x64 dan arm64 dengan dukungan CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, dan ROCm 10.0
- Android arm64 untuk CPU dan Snapdragon (CPU, GPU Adreno, NPU Hexagon)
- Linux arm64 untuk perangkat Snapdragon termasuk CPU, GPU Adreno, dan NPU Hexagon
- Build UI mandiri juga tersedia.
Pembaruan ini memungkinkan pengguna menjalankan llama.cpp pada berbagai arsitektur, khususnya meningkatkan dukungan untuk prosesor Qualcomm Snapdragon dengan NPU Hexagon melalui direktori DMA terpetakan langsung yang baru.