Le projet llama.cpp a publié la version b10970, qui inclut une mise à jour technique du backend fattn-mma. Ce changement implémente l'utilisation d'accumulateurs fp32 spécifiquement pour les dispositifs de l'architecture CDNA.
- La publication fournit des binaires pour macOS (Apple Silicon et Intel), Linux (Ubuntu x64/arm64/s390x), Windows et Android.
- Le support GPU inclut CUDA 12/13, Vulkan, ROCm 10.0, OpenVINO, SYCL et OpenCL Adreno sur les plateformes prises en charge.
- Une correction spécifique traite de la précision en utilisant l'accumulation fp32 sur les appareils MFMA au sein du module fattn-mma.