llama.cpp プロジェクトはバージョン b10539 をリリースしました。これは Vulkan バックエンドの重要な数値安定性の問題を解決し、Windows ユーザー向けのハードウェアサポートを拡張します。

  • Vulkan FA MMQ は、qd が非正規化数(denorm)の場合にオーバーフローを防ぐため、Q 量子化計算に fp32 を使用します。
  • CUDA 13 用の Windows x64 バイナリと、CUDA 13.4 対応の Windows arm64 向けプレビューサポートを追加しました。
  • Ubuntu s390x (CPU)、macOS Intel (x64)、iOS XCFramework のビルドを含めました。
  • OpenCL Adreno サポートが Windows arm64 で利用可能になりました。

このアップデートは、演算エラーを防ぐことで Vulkan デバイスでの信頼性の高いパフォーマンスを保証し、ユーザーに最新の CUDA 13 互換オプションを提供します。