أصدر مشروع llama.cpp الإصدار b10238، الذي يقدم دعم التنبؤ متعدد الرموز (MTP) لعائلة نماذج Qwen3-Next. يتضمن هذا التحديث تغييرات تنفيذية محددة للتعامل مع طبقات MTP وإصلاحات تتعلق بفحص الأنواع في بايثون داخل قاعدة الشفرة.
- تمت إضافة دعم MTP لنماذج Qwen3-Next في src/models/qwen3next.cpp.
- تم إصلاح حساب num_mtp مباشرة من طبقات MTP وتعريف opt_num_mtp_layers في _QwenMtpMixin.
- تم حل مشكلات فحص الأنواع في بايثون وتحديث gguf-py/gguf/constants.py.
- تم توفير ملفات ثنائية لأنظمة macOS (Apple Silicon/Intel)، وLinux (CPU، Vulkan، ROCm، OpenVINO، SYCL)، وAndroid، وWindows (CPU، CUDA 12/13، Vulkan، OpenCL، OpenVINO، SYCL، HIP)، وopenEuler.
يتيح هذا الإصدار للمستخدمين تشغيل نماذج Qwen3-Next بقدرات MTP على مجموعة واسعة من بنية الأجهزة وأنظمة التشغيل.