llama.cpp 项目发布了版本 b10705,其中包括对 TENSOR_READ_LAZY 处理机制的改进。当启用延迟设置时,此更新会强制在 CPU 上加载延迟张量。
- 改进了 llama.cpp 中的 TENSOR_READ_LAZY 处理
- 在延迟模式激活时强制 CPU 上的延迟张量行为
此版本为 macOS、Linux、Windows、Android 和 iOS 提供了更新的二进制文件,支持包括 CPU、CUDA、ROCm、Vulkan 和 OpenVINO 在内的各种硬件后端。
llama.cpp 项目发布了版本 b10705,其中包括对 TENSOR_READ_LAZY 处理机制的改进。当启用延迟设置时,此更新会强制在 CPU 上加载延迟张量。
此版本为 macOS、Linux、Windows、Android 和 iOS 提供了更新的二进制文件,支持包括 CPU、CUDA、ROCm、Vulkan 和 OpenVINO 在内的各种硬件后端。