llama.cpp プロジェクトはバージョン b10539 をリリースしました。これは Vulkan バックエンドの重要な数値安定性の問題を解決し、Windows ユーザー向けのハードウェアサポートを拡張します。
- Vulkan FA MMQ は、qd が非正規化数(denorm)の場合にオーバーフローを防ぐため、Q 量子化計算に fp32 を使用します。
- CUDA 13 用の Windows x64 バイナリと、CUDA 13.4 対応の Windows arm64 向けプレビューサポートを追加しました。
- Ubuntu s390x (CPU)、macOS Intel (x64)、iOS XCFramework のビルドを含めました。
- OpenCL Adreno サポートが Windows arm64 で利用可能になりました。
このアップデートは、演算エラーを防ぐことで Vulkan デバイスでの信頼性の高いパフォーマンスを保証し、ユーザーに最新の CUDA 13 互換オプションを提供します。