llama.cpp 项目发布了版本 b10970,其中包含对 fattn-mma 后端的更新。此更改专门针对 CDNA 架构设备实现了 fp32 累加器的使用。

  • 该发布版提供了适用于 macOS(Apple Silicon 和 Intel)、Linux(Ubuntu x64/arm64/s390x)、Windows 和 Android 的二进制文件。
  • GPU 支持包括 CUDA 12/13、Vulkan、ROCm 10.0、OpenVINO、SYCL 以及受支持平台上的 OpenCL Adreno。
  • 一项特定的修复通过在 fattn-mma 模块内的 MFMA 设备上使用 fp32 累加来解决精度问题。