llama.cpp 项目发布了版本 b10589,通过 pull request #27573 引入了 CUDA POOL_1D 支持。此更新还包括通过添加缺失的尾随换行符来修复 editorconfig 合规性。
该版本为 macOS(Apple Silicon 和 Intel)、iOS、Linux(Ubuntu x64、arm64、s390x)、Windows(x64 和 arm64)以及 Android 提供二进制文件。支持的后端包括 CPU、CUDA 12/13、Vulkan、ROCm 7.14、OpenVINO、SYCL 和 OpenCL Adreno。
此版本使用户能够在新 pooling 功能的帮助下,在各种硬件架构和操作系统上运行 llama.cpp。