Proyek llama.cpp merilis versi b10219, yang mencakup perbaikan untuk CLI agar dapat mempertahankan konten penalaran dalam riwayat obrolan. Sebelumnya, meskipun `llama-cli` mengumpulkan penalaran dari stream untuk ditampilkan, ia hanya menyimpan konten asisten dalam pesan, mencegah flag `--reasoning-preserve` menyuntikkan kembali pemikiran sebelumnya pada giliran berikutnya.

Pembaruan ini memastikan bahwa langkah-langkah penalaran sekarang disimpan dengan benar dalam riwayat pesan, memungkinkan percakapan multi-giliran mempertahankan konteks proses pemikiran internal model. Rilis ini menyediakan biner untuk macOS (Apple Silicon dan Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenCL, OpenVINO, SYCL, HIP), dan openEuler.

Dengan memperbaiki masalah persistensi ini, pengguna sekarang dapat secara efektif menggunakan opsi `--reasoning-preserve` untuk meneruskan konteks penalaran di seluruh giliran dalam interaksi CLI.