O projeto llama.cpp lançou a compilação b10269, que inclui uma correção para o problema de reshape do dflash wo_a durante o carregamento do modelo.

Esta versão fornece binários para macOS (Apple Silicon e Intel), iOS, Linux (Ubuntu x64, arm64, s390x com backends CPU, Vulkan, ROCm 7.2, OpenVINO e SYCL), Android (arm64), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, HIP) e openEuler (x86 e aarch64 com ACL Graph).

A atualização está disponível para download em todas as plataformas suportadas para garantir o comportamento correto do carregamento do modelo.