El proyecto llama.cpp ha lanzado la compilación b10269, que incluye una corrección para el problema de reshaping wo_a de dflash durante la carga del modelo.

Esta versión proporciona binarios para macOS (Apple Silicon e Intel), iOS, Linux (Ubuntu x64, arm64, s390x con backends de CPU, Vulkan, ROCm 7.2, OpenVINO y SYCL), Android (arm64), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, HIP) y openEuler (x86 y aarch64 con ACL Graph).

La actualización está disponible para descarga en todas las plataformas compatibles para garantizar un comportamiento correcto al cargar el modelo.