Проект llama.cpp выпустил сборку b11382, которая включает важное обновление бэкенда WebGPU. Этот релиз добавляет поддержку 16-битной плавающей точки (f16) специально для операций `fill` и `set_rows` в реализации WebGPU.
- Изменения в исходном коде отслеживаются в pull request #29897 в репозитории ggml-org/llama.cpp.
- Бинарные файлы предоставляются для macOS (Apple Silicon и Intel), iOS, Linux (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL, Snapdragon), Windows (CPU, OpenCL, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android и openEuler.
- Релиз также включает стандартный бинарный файл UI llama.cpp.