أصدر مشروع llama.cpp الإصدار b10238، الذي يقدم دعم التنبؤ متعدد الرموز (MTP) لعائلة نماذج Qwen3-Next. يتضمن هذا التحديث تغييرات تنفيذية محددة للتعامل مع طبقات MTP وإصلاحات تتعلق بفحص الأنواع في بايثون داخل قاعدة الشفرة.

  • تمت إضافة دعم MTP لنماذج Qwen3-Next في src/models/qwen3next.cpp.
  • تم إصلاح حساب num_mtp مباشرة من طبقات MTP وتعريف opt_num_mtp_layers في _QwenMtpMixin.
  • تم حل مشكلات فحص الأنواع في بايثون وتحديث gguf-py/gguf/constants.py.
  • تم توفير ملفات ثنائية لأنظمة macOS (Apple Silicon/Intel)، وLinux (CPU، Vulkan، ROCm، OpenVINO، SYCL)، وAndroid، وWindows (CPU، CUDA 12/13، Vulkan، OpenCL، OpenVINO، SYCL، HIP)، وopenEuler.

يتيح هذا الإصدار للمستخدمين تشغيل نماذج Qwen3-Next بقدرات MTP على مجموعة واسعة من بنية الأجهزة وأنظمة التشغيل.