llama.cpp 项目发布了 b10254 版本,为 DeepSeek V4 Flash 0731 模型引入了新的聊天模板,并对现有的 DeepSeek V4 模板进行了更新。

  • 将 DeepSeek V4 模板与官方编码器对齐,同时排除解析器行为的变化。
  • 除非请求 preserve_reasoning 或存在工具,否则默认丢弃 DeepSeek V4 的思考历史。
  • 添加结构化输出的响应格式指令,并将模式传入模板渲染过程。
  • 引入单独的 Flash 0731 模板以处理更新后的高推理和最大推理努力映射。
  • 包含修复 DSML 解析器工具调用分隔符消耗以及 deepseek v4 0731 模板选择的问题。

此更新确保与最新的 DeepSeek 模型规范兼容,并改进了结构化输出处理。