llama.cpp 项目发布了构建版本 b10886,引入了对 s390x 架构的 Q1_0 向量内置支持。此更新包括 `ggml_vec_dot_q1_0_q8_0` 的实现,并更新了文档以反映新功能。

  • ggml-cpu 为 s390x 添加了 `ggml_vec_dot_q1_0_q8_0` 支持。
  • ggml-cpu 中的变量命名进行了清理,以提高可读性。
  • 文档已更新,包含对 Q1_0 量化的支持。

此版本为 macOS、Linux(包括 Ubuntu x64、arm64 和 s390x)、Android、Windows 和 openEuler 提供了二进制文件,适用于 CPU、Vulkan、ROCm、OpenVINO、SYCL 和 CUDA 等各种硬件后端。