أصدر مشروع llama.cpp الإصدار b10434، الذي يضيف دعمًا لتمرير معلمة `reasoning_effort` إلى قوالب Jinja. يضمن هذا التغيير تخزين قيم `reasoning_effort` من OpenAI Chat Completions وجعلها متاحة أثناء التوليد.

  • يقرأ الخادم الآن `reasoning_effort` بشكل صحيح من جسم الطلب.
  • تتعامل منطق تحويل Responses API مع تعيين `reasoning.effort` إلى `reasoning_effort`.
  • يتم تعريض المعلمة في `generation_params` وتوضع بجانب `enable_thinking`.
  • يتم تمرير السياق عبر دالة analyze لعكس سلوك `preserve_reasoning`.

يتيح هذا التحديث للمستخدمين التحكم مباشرة في مستويات جهد الاستدلال عبر مدخلات القالب، مما يسهل تكوينًا أكثر تفصيلاً لمعلمات استنتاج النموذج.