llama.cpp プロジェクトはビルド b11333 をリリースし、WebGPU バックエンド内の MUL_MAT、MUL_MAT_ID、および GET_ROWS 操作に対する bfloat16 サポートを導入しました。

このアップデートは、macOS (Apple Silicon および Intel)、iOS、Linux (Ubuntu x64、arm64、s390x)、Windows、Android、openEuler のプリコンパイル済みバイナリに含まれています。リリースでは、CUDA 12 および 13、Vulkan、ROCm 10.0、OpenVINO、SYCL、Snapdragon NPUs を含むさまざまなハードウェア アクセラレータ向けのビルドが提供されています。

これらの特定の WebGPU 行列操作に bfloat16 精度を追加することで、互換性のある GPU でより効率的な計算が可能になります。