llama.cpp 项目发布了构建版本 b11301,其中包含对 ggml 和 gguf 组件中整数溢出问题的修复。此更新改进了验证逻辑,以防止在处理零元素张量时出现潜在错误。
- 修复了 ggml 中针对零元素张量的整数溢出保护。
- 验证张量中的元素数量以防止整数溢出。
- 修正了 ggml 模块中的错误打印。
该版本为 macOS、Linux、Windows、Android 和 openEuler 提供了适用于 CPU、GPU(CUDA、Vulkan、ROCm、OpenCL)和 NPU 后端的二进制文件。