llama.cpp プロジェクトはビルド b11382 をリリースし、WebGPU バックエンドの重要なアップデートを含んでいます。このリリースでは、WebGPU 実装内の `fill` および `set_rows` 操作に対して 16 ビット浮動小数点 (f16) サポートが追加されました。

  • ソースコードの変更は ggml-org/llama.cpp リポジトリのプルリクエスト #29897 で追跡されています。
  • macOS (Apple Silicon および Intel)、iOS、Linux (CPU、Vulkan、CUDA 12/13、ROCm、OpenVINO、SYCL、Snapdragon)、Windows (CPU、OpenCL、CUDA、Vulkan、OpenVINO、SYCL、ROCm)、Android、および openEuler のバイナリが提供されています。
  • リリースには標準的な llama.cpp UI バイナリも含まれています。