llama.cpp 项目已发布构建版本 b10269,其中包含对模型加载期间 dflash wo_a reshape 问题的修复。
此版本提供了适用于 macOS(Apple Silicon 和 Intel)、iOS、Linux(Ubuntu x64、arm64、s390x,支持 CPU、Vulkan、ROCm 7.2、OpenVINO 和 SYCL 后端)、Android(arm64)、Windows(CPU、OpenCL Adreno、CUDA 12/13、Vulkan、OpenVINO、SYCL、HIP)以及 openEuler(x86 和 aarch64,支持 ACL Graph)的二进制文件。
该更新可在所有受支持的平台上下载,以确保正确的模型加载行为。