أصدر مشروع llama.cpp الإصدار b10282، الذي يقدم قدرات مراقبة جديدة للترميز التخميني. يتضمن الخادم الآن عدادات spec-decode في نقطة النهاية الخاصة به /metrics، مما يسمح للمستخدمين بتتبع مقاييس الأداء المتعلقة بهذه الميزة.

  • تمت إضافة عدادات spec-decode إلى نقطة النهاية /metrics لتحسين إمكانية المراقبة.
  • تم محاذاة أسماء المعاملات تمامًا مع vLLM بعد مراجعة التعليقات.
  • تم توفير ملفات ثنائية لأنظمة macOS (Apple Silicon و Intel)، و iOS، و Linux (CPU، Vulkan، ROCm، OpenVINO، SYCL)، و Android، و Windows (CPU، CUDA، Vulkan، OpenVINO، SYCL، HIP)، و openEuler.

يحسن هذا التحديث القدرة على مراقبة أداء الترميز التخميني مع الحفاظ على التوافق مع اتفاقيات تسمية معاملات vLLM.