llama.cppプロジェクトは、モデル読み込み時のdflash wo_aの再整形問題に対する修正を含むビルドb10269をリリースしました。

このリリースでは、macOS(Apple SiliconおよびIntel)、iOS、Linux(Ubuntu x64、arm64、s390x。CPU、Vulkan、ROCm 7.2、OpenVINO、SYCLバックエンド付き)、Android(arm64)、Windows(CPU、OpenCL Adreno、CUDA 12/13、Vulkan、OpenVINO、SYCL、HIP)、openEuler(ACL Graph付きx86およびaarch64)向けのバイナリが提供されます。

正しいモデル読み込み動作を確保するため、この更新はすべてのサポート対象プラットフォームでダウンロード可能です。