Проект llama.cpp выпустил версию b10219, которая включает исправление для CLI, позволяющее сохранять содержимое рассуждений в истории чата. Ранее, хотя `llama-cli` собирал рассуждения из потока для отображения, он сохранял только контент ассистента в сообщениях, что не позволяло флагу `--reasoning-preserve` повторно внедрять предыдущие мысли в последующих ходах.

Это обновление гарантирует, что шаги рассуждений теперь правильно сохраняются в истории сообщений, позволяя многооборотным разговорам поддерживать контекст внутреннего процесса мышления модели. Релиз предоставляет бинарные файлы для macOS (Apple Silicon и Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenCL, OpenVINO, SYCL, HIP) и openEuler.

Исправив эту проблему с сохранением, пользователи теперь могут эффективно использовать опцию `--reasoning-preserve` для передачи контекста рассуждений через несколько ходов в CLI взаимодействиях.