llama.cpp 项目在 pull request #28682 中为 Ling 3.0 (Bailing V3) 聊天模板引入了专用解析器。此更改解决了模型预打开的思考块导致工具调用被错误分类为推理内容,从而导致智能体循环失败的问题。

新的解析器在关闭的 think 标签或工具调用标签开始时终止推理,模仿了 vLLM 和 SGLang 中的行为。它包括针对未关闭的 think 块、并行调用和各种参数类型的全面测试。

此更新确保客户端正确接收工具调用而非空内容,使智能体循环能够与 Ling 3.0 模型正常运行。