llama.cpp プロジェクトはビルド b11382 をリリースし、WebGPU バックエンドの重要なアップデートを含んでいます。このリリースでは、WebGPU 実装内の `fill` および `set_rows` 操作に対して 16 ビット浮動小数点 (f16) サポートが追加されました。
- ソースコードの変更は ggml-org/llama.cpp リポジトリのプルリクエスト #29897 で追跡されています。
- macOS (Apple Silicon および Intel)、iOS、Linux (CPU、Vulkan、CUDA 12/13、ROCm、OpenVINO、SYCL、Snapdragon)、Windows (CPU、OpenCL、CUDA、Vulkan、OpenVINO、SYCL、ROCm)、Android、および openEuler のバイナリが提供されています。
- リリースには標準的な llama.cpp UI バイナリも含まれています。