llama.cpp 项目发布了版本 b10930,其中包含对服务器组件的修复,即使用户已达到其模型限制,也允许下载模型。

  • 通过启用限额内的下载来解决 issue #26809(PR #28530)。
  • 提供 macOS Apple Silicon 和 Intel、iOS、Ubuntu x64/arm64/s390x、Android arm64、Windows x64/arm64 以及 openEuler 的二进制文件。
  • 支持各种硬件后端,包括 CPU、Vulkan、ROCm 10.0、OpenVINO、SYCL FP32/FP16、CUDA 12/13 和 OpenCL Adreno。

此更新确保用户在达到存储配额时仍能继续使用,同时提供广泛的平台支持。