يحل إصدار llama.cpp b10338 خطأً حرجاً في مُوفّر النموذج تسبب في فشل تحميل نماذج Mixture-of-Experts (MoE) ذات الخبراء المشتركين بعد حفظها. يعود سبب المشكلة إلى كتابة المُوفّر لقيمة `n_ff_chexp` بشكل غير صحيح في المفتاح `LLM_KV_EXPERT_SHARED_FEED_FORWARD_LENGTH`، مما أدى إلى طمس معلومات شكل المصفوفة الصحيحة.
- يضمن الإصلاح أن الكتابة الثانية تستخدم المفتاح الصحيح `LLM_KV_EXPERT_CHUNK_FEED_FORWARD_LENGTH` بدلاً من الكتابة فوق طول التغذية الأمامية المشترك.
- يحل هذا الفشل في التحميل للبنى المعمارية ذات الخبراء المشتركين، بما في ذلك qwen2moe وqwen3-next وgranite-moe وhunyuan-moe وernie4.5 وbailingmoe2 وnemotron-h.
- يتضمن الإصدار ثنائيات لأنظمة macOS (Apple Silicon وIntel) وiOS وLinux (CPU وVulkan وROCm وOpenVINO وSYCL) وAndroid وWindows (CPU وCUDA 12/13 وVulkan وOpenCL وOpenVINO وSYCL وHIP) وopenEuler.
يضمن هذا الإصلاح نجاح دورات الحفظ والتحميل لنماذج MoE ذات الخبراء المشتركين دون عدم تطابق في أشكال المصفوفات.