llama.cppプロジェクトはバージョンb10970をリリースしました。これにはfattn-mmaバックエンドの技術的な更新が含まれています。この変更により、CDNAアーキテクチャのデバイス用にfp32累算器の使用が実装されました。

  • このリリースでは、macOS(Apple SiliconおよびIntel)、Linux(Ubuntu x64/arm64/s390x)、Windows、Android用のバイナリが提供されています。
  • GPUサポートには、対応プラットフォーム上でCUDA 12/13、Vulkan、ROCm 10.0、OpenVINO、SYCL、OpenCL Adrenoが含まれます。
  • 特定の修正では、fattn-mmaモジュール内のMFMAデバイスでfp32累積を使用することで精度の問題に対処しています。