llama.cppプロジェクトは、新しいhex-dma機能を含むビルドb11118をリリースしました。この機能は、Hexagon Vector eXtended (HVX) FAマスク処理により適したダイレクトマップDMAキャッシュを導入しています。

このリリースでは、複数のプラットフォームとハードウェアバックエンド間でバイナリとフレームワークが提供されます:

  • macOS Apple Silicon (arm64)、macOS Intel (x64)、およびiOS XCFramework
  • Linux Ubuntu x64、arm64、s390x、およびCUDA 12/13、ROCm 10.0、OpenVINO、SYCL、Vulkanを含む各種GPU/CPUバックエンド
  • CPU、OpenCL Adreno、CUDA 12/13、Vulkan、OpenVINO、SYCL、およびROCm 10.0をサポートするWindows x64とarm64
  • CPUおよびSnapdragon (CPU、Adreno GPU、Hexagon NPU)用のAndroid arm64
  • CPU、Adreno GPU、およびHexagon NPUを含むSnapdragonデバイス用のLinux arm64
  • スタンドアロンUIビルドも利用可能です。

このアップデートにより、ユーザーは幅広いアーキテクチャでllama.cppを実行できるようになり、特に新しいダイレクトマップDMAキャッシュを通じてQualcomm SnapdragonプロセッサのHexagon NPUのサポートが強化されました。