أصدر مشروع llama.cpp الإصدار b10219، والذي يتضمن إصلاحًا لواجهة سطر الأوامر (CLI) للحفاظ على محتوى الاستدلال داخل سجل الدردشة. سابقًا، بينما كان `llama-cli` يجمع الاستدلال من التدفق للعرض، كان يخزن فقط محتوى المساعد في الرسائل، مما منع العلم `--reasoning-preserve` من إعادة حقن الأفكار السابقة في الأدوار اللاحقة.
يضمن هذا التحديث الآن الاحتفاظ بخطوات الاستدلال بشكل صحيح في سجل الرسائل، مما يسمح للمحادثات متعددة الأدوار بالحفاظ على سياق عملية التفكير الداخلية للنموذج. يوفر الإصدار ملفات ثنائية لأنظمة macOS (Apple Silicon وIntel)، وiOS، وLinux (CPU، Vulkan، ROCm، OpenVINO، SYCL)، وAndroid، وWindows (CPU، CUDA 12/13، Vulkan، OpenCL، OpenVINO، SYCL، HIP)، وopenEuler.
من خلال إصلاح هذه المشكلة في الاستمرارية، يمكن للمستخدمين الآن استخدام خيار `--reasoning-preserve` بشكل فعال لنقل سياق الاستدلال عبر أدوار متعددة في تفاعلات واجهة سطر الأوامر.