أصدر مشروع llama.cpp الإصدار b10247، الذي يعالج مشكلات الاستقرار عند تحميل نماذج التخصيب الكبير (MoE) الكبيرة في إعدادات متعددة الخلفيات. يستبدل التحديث المصفوفات ذات الحجم الثابت في مخطط الخلفية بمخازن مؤقتة مُخصصة ديناميكيًا للتعامل مع تقسيمات الرسم البياني التي تتجاوز 30 مدخلًا.

  • استبدال GGML_SCHED_MAX_SPLIT_INPUTS بالتخصيص الديناميكي لمدخلات الرسم البياني المقسمة.
  • إصلاح الانهيارات عند تحميل نماذج MoE العريضة مثل Gemma 4 و Qwen MoE و Mixtral و DeepSeek.
  • تحديث حساب graph_size لاستخدام عدد المدخلات الفعلي بدلاً من ثابت ثابت.
  • توفير ثنائيات لأنظمة macOS (Apple Silicon/Intel) و Linux (CPU/Vulkan/ROCm/OpenVINO/SYCL) و Windows (CPU/CUDA/Vulkan/OpenVINO/SYCL/HIP) و Android و iOS.

يتيح هذا التغيير للمستخدمين تشغيل بنية MoE المعقدة دون مواجهة انهيرات مرتبطة بالمخطط على الأنظمة ذات الأجهزة الخلفية المتعددة.