llama.cpp 项目发布了构建版本 b10696,其中包含一个拉取请求,专门为 Apple M3 Pro 芯片添加了快速向量 (fa-vec) 调优。
此更新解决了问题 #27668,以改善特定硬件配置上的性能。该版本提供了适用于 macOS、iOS、Linux、Windows、Android 和 openEuler 的二进制文件,支持包括 CPU、CUDA、ROCm、Vulkan、OpenVINO 和 SYCL 在内的各种后端。
fa-vec 调优旨在优化在配备 M3 Pro 处理器的设备上运行 llama.cpp 的用户推理速度或效率。