أصدر مشروع llama.cpp الإصدار b10434، الذي يضيف دعمًا لتمرير معلمة `reasoning_effort` إلى قوالب Jinja. يضمن هذا التغيير تخزين قيم `reasoning_effort` من OpenAI Chat Completions وجعلها متاحة أثناء التوليد.
- يقرأ الخادم الآن `reasoning_effort` بشكل صحيح من جسم الطلب.
- تتعامل منطق تحويل Responses API مع تعيين `reasoning.effort` إلى `reasoning_effort`.
- يتم تعريض المعلمة في `generation_params` وتوضع بجانب `enable_thinking`.
- يتم تمرير السياق عبر دالة analyze لعكس سلوك `preserve_reasoning`.
يتيح هذا التحديث للمستخدمين التحكم مباشرة في مستويات جهد الاستدلال عبر مدخلات القالب، مما يسهل تكوينًا أكثر تفصيلاً لمعلمات استنتاج النموذج.