llama.cpp 项目发布了构建版本 b10290,在 ggml 库中引入了新的 `ggml_build_forward_order` 函数。此更改解决了 mtmd 音频图中的错误,该错误在使用 `ggml_build_forward_expand` 作为纯排序提示时,导致未选中的分支使用陈旧输入执行。

  • 以前的方法强制在未选中的分支上进行计算,由于陈旧的 `inp_code0` 数据,导致 CPU 上的 `get_rows` 边界断言失败。
  • 新函数插入不带计算标志的节点,仅在分支实际被选中时才恢复该标志。
  • 构建版本 b10290 提供了 macOS(Apple Silicon 和 Intel)、Linux(CPU、Vulkan、ROCm、OpenVINO、SYCL)、Android、Windows(CPU、CUDA 12/13、Vulkan、OpenCL、OpenVINO、SYCL、HIP)和 openEuler 的二进制文件。
  • 发布版本中还包含 iOS XCFramework 和独立 UI 构建。