llama.cpp プロジェクトはビルド b10721 をリリースしました。これには WebGPU バックエンドの重要な修正と、Windows 上のハードウェアサポートの拡張が含まれています。

  • オフセットが 4 の倍数でない場合に WebGPU `ggml_backend_tensor_get()` 実装でクラッシュする問題を修正。
  • CUDA 13.4 を搭載した Windows arm64 のプレビューサポートを追加。
  • macOS (Apple Silicon および Intel)、Linux (CPU、Vulkan、ROCm、OpenVINO、SYCL)、Android、および各種 CPU および GPU バックエンドに対応する Windows 用のバイナリを提供。

このリリースにより、アライメントされていないメモリオフセットを持つ WebGPU ユーザーの安定性が確保され、Windows 上の新しい CUDA アーキテクチャとの互換性が拡張されました。