llama.cpp プロジェクトはビルド b10150 をリリースしました。これには、重みのバックエンドへの演算のオフロードに関する ggml ロジックの調整が含まれています。このアップデートでは、llama dsv4 グラフの修正も対応しています。

  • ggml: 重みバックエンドへの演算オフロードロジックを調整
  • llama: dsv4 グラフの修正

本リリースでは、CPU、CUDA、Vulkan、ROCm、OpenVINO を含む様々なハードウェアバックエンド向けに、macOS、Linux、Windows、Android、iOS 用の更新されたバイナリが提供されています。