Proyek llama.cpp telah memperkenalkan parser khusus untuk template obrolan Ling 3.0 (Bailing V3) dalam pull request #28682. Perubahan ini mengatasi masalah di mana blok berpikir yang terbuka sebelumnya dari model menyebabkan panggilan alat diklasifikasikan secara salah sebagai konten penalaran, yang mengakibatkan kegagalan loop agen.
Parser baru mengakhiri penalaran pada tag think penutup atau awal tag panggilan alat, meniru perilaku di vLLM dan SGLang. Ini mencakup pengujian komprehensif untuk blok think yang tidak ditutup, panggilan paralel, dan berbagai jenis argumen.
Pembaruan ini memastikan bahwa klien menerima panggilan alat dengan benar alih-alih konten kosong, memungkinkan loop agen berfungsi dengan baik dengan model Ling 3.0.