أصدر مشروع llama.cpp الإصدار b10947، الذي يعالج انهيارًا حرجًا أثناء تحميل نموذج Nemotron-H. يحمي التحديث من خطأ القسمة على صفر الذي حدث عندما استخرج حلقة الذيل NextN/MTP حجم FFN للخبير من مصفوفات لكل طبقة تحتوي على قيم صفرية للطبقات غير MoE.

  • يصلح انهيار SIGFPE عن طريق الإبلاغ عن بيانات تعريف معيبة بدلاً من القسمة على صفر عند غياب expert_feed_forward_length.
  • يوفر ملفات ثنائية لأنظمة macOS (Apple Silicon و Intel) و iOS و Linux (CPU و Vulkan و ROCm و OpenVINO و SYCL) و Android و Windows (CPU و CUDA 12/13 و OpenCL و Vulkan و OpenVINO و SYCL و ROCm) و openEuler.

يمنع هذا التغيير التطبيق من التعطل بخطأ إشارة أثناء تحميل نقطة التفتيش، مما يضمن تشغيلًا مستقرًا للنماذج ذات الطبقات المختلطة من MoE والطبقات الكثيفة.