llama.cppプロジェクトは、新しいhex-dma機能を含むビルドb11118をリリースしました。この機能は、Hexagon Vector eXtended (HVX) FAマスク処理により適したダイレクトマップDMAキャッシュを導入しています。
このリリースでは、複数のプラットフォームとハードウェアバックエンド間でバイナリとフレームワークが提供されます:
- macOS Apple Silicon (arm64)、macOS Intel (x64)、およびiOS XCFramework
- Linux Ubuntu x64、arm64、s390x、およびCUDA 12/13、ROCm 10.0、OpenVINO、SYCL、Vulkanを含む各種GPU/CPUバックエンド
- CPU、OpenCL Adreno、CUDA 12/13、Vulkan、OpenVINO、SYCL、およびROCm 10.0をサポートするWindows x64とarm64
- CPUおよびSnapdragon (CPU、Adreno GPU、Hexagon NPU)用のAndroid arm64
- CPU、Adreno GPU、およびHexagon NPUを含むSnapdragonデバイス用のLinux arm64
- スタンドアロンUIビルドも利用可能です。
このアップデートにより、ユーザーは幅広いアーキテクチャでllama.cppを実行できるようになり、特に新しいダイレクトマップDMAキャッシュを通じてQualcomm SnapdragonプロセッサのHexagon NPUのサポートが強化されました。