llama.cpp 项目发布了版本 b10229,其中包含针对 OpenCL 后端的严重错误修复。该更新解决了在程序终止期间未能写入分析数据的问题。
- 该修复通过增加 `ggml_backend_opencl_init()` 中的 `ref_count` 来防止其在 `free()` 方法中变为 -1。
- 这确保了当启用 `GGML_OPENCL_PROFILING` 时,分析数据能够正确刷新并保存。
- 二进制文件适用于 macOS、Linux、Windows、Android 和 openEuler,涵盖 CPU、CUDA、Vulkan、ROCm、OpenVINO、SYCL 和 HIP 后端。
此更改确保依赖 OpenCL 分析的用户可以成功捕获和分析性能指标,而不会丢失数据。