llama.cpp 项目发布了构建版本 b11298,引入了对 dflash 格式的支持。此更新支持将模型转换为该格式以及后续的特征提取功能。
- 模型转换工具已更新以处理 dflash 输入。
- dflash 模型现在可用特征提取功能。
- 在开发过程中修复了 'cont' 组件。
- 为 macOS、Linux、Windows、Android 和 openEuler 提供了适用于 CPU、GPU (CUDA, Vulkan, ROCm, OpenCL) 和 NPU 后端的二进制文件。
此版本允许用户在 llama.cpp 生态系统中使用 dflash 模型。