llama.cpp 项目发布了构建版本 b11298,引入了对 dflash 格式的支持。此更新支持将模型转换为该格式以及后续的特征提取功能。

  • 模型转换工具已更新以处理 dflash 输入。
  • dflash 模型现在可用特征提取功能。
  • 在开发过程中修复了 'cont' 组件。
  • 为 macOS、Linux、Windows、Android 和 openEuler 提供了适用于 CPU、GPU (CUDA, Vulkan, ROCm, OpenCL) 和 NPU 后端的二进制文件。

此版本允许用户在 llama.cpp 生态系统中使用 dflash 模型。