El proyecto llama.cpp ha lanzado la versión b11280, que incluye un cambio para reducir la sincronización allreduce de tensores utilizando buffers host fijados.

Esta actualización está disponible en múltiples plataformas y backends, incluyendo macOS (Apple Silicon e Intel), Linux (CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, SYCL y Snapdragon), Windows (CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL y ROCm 10.0), Android e iOS.

El lanzamiento también proporciona binarios para la interfaz de llama.cpp.