El proyecto llama.cpp ha lanzado la compilación b11382, que incluye una actualización clave para su backend de WebGPU. Esta versión añade soporte de punto flotante de 16 bits (f16) específicamente para las operaciones `fill` y `set_rows` dentro de la implementación de WebGPU.
- El cambio en el código fuente está rastreado en el pull request #29897 del repositorio ggml-org/llama.cpp.
- Se proporcionan binarios para macOS (Apple Silicon e Intel), iOS, Linux (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL, Snapdragon), Windows (CPU, OpenCL, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android y openEuler.
- El lanzamiento también incluye el binario estándar de la interfaz de usuario de llama.cpp.