O projeto llama.cpp lançou a versão b10970, que inclui uma atualização técnica no backend fattn-mma. Esta alteração implementa o uso de acumuladores fp32 especificamente para dispositivos da arquitetura CDNA.
- O lançamento fornece binários para macOS (Apple Silicon e Intel), Linux (Ubuntu x64/arm64/s390x), Windows e Android.
- O suporte a GPU inclui CUDA 12/13, Vulkan, ROCm 10.0, OpenVINO, SYCL e OpenCL Adreno nas plataformas suportadas.
- Uma correção específica aborda a precisão usando acumulação fp32 em dispositivos MFMA dentro do módulo fattn-mma.