Le projet llama.cpp a publié la version b10269, qui inclut une correction pour le problème de reshape dflash wo_a lors du chargement du modèle.

Cette version fournit des binaires pour macOS (Apple Silicon et Intel), iOS, Linux (Ubuntu x64, arm64, s390x avec les backends CPU, Vulkan, ROCm 7.2, OpenVINO et SYCL), Android (arm64), Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, HIP) et openEuler (x86 et aarch64 avec ACL Graph).

La mise à jour est disponible au téléchargement sur toutes les plateformes prises en charge pour garantir un comportement correct lors du chargement des modèles.