Le projet llama.cpp a publié la version b10947, qui résout un plantage critique au chargement du modèle Nemotron-H. La mise à jour protège contre une erreur de diviseur zéro survenant lorsque la boucle de queue NextN/MTP dérivait la taille FFN de l'expert à partir de tableaux par couche contenant des valeurs nulles pour les couches non MoE.

  • Corrige le plantage SIGFPE en signalant des métadonnées malformées au lieu de diviser par zéro lorsque expert_feed_forward_length est manquant.
  • Fournit des binaires pour macOS (Apple Silicon et Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, OpenCL, Vulkan, OpenVINO, SYCL, ROCm) et openEuler.

Ce changement empêche l'application de planter avec une erreur de signal lors du chargement du point de contrôle, garantissant un fonctionnement stable pour les modèles avec des couches MoE et denses mélangées.