llama.cpp 프로젝트는 새로운 hex-dma 기능을 포함하는 빌드 b11118을 출시했으며, 이는 Hexagon Vector eXtended (HVX) FA 마스크 처리에 더 적합한 직접 매핑 DMA 캐시를 소개합니다.
이번 릴리스는 여러 플랫폼과 하드웨어 백엔드에서 바이너리와 프레임워크를 제공합니다:
- macOS Apple Silicon (arm64), macOS Intel (x64), iOS XCFramework
- Linux Ubuntu x64, arm64, s390x 및 CUDA 12/13, ROCm 10.0, OpenVINO, SYCL, Vulkan을 포함한 다양한 GPU/CPU 백엔드
- CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm 10.0 지원을 갖춘 Windows x64 및 arm64
- CPU 및 Snapdragon (CPU, Adreno GPU, Hexagon NPU)용 Android arm64
- CPU, Adreno GPU, Hexagon NPU를 포함한 Snapdragon 장치용 Linux arm64
- 독립형 UI 빌드도 제공됩니다.
이 업데이트는 사용자가 다양한 아키텍처에서 llama.cpp를 실행할 수 있도록 하며, 특히 새로운 직접 매핑 DMA 캐시를 통해 Qualcomm Snapdragon 프로세서의 Hexagon NPU 지원 개선에 중점을 둡니다.