O projeto llama.cpp lançou a versão b10947, que aborda uma falha crítica no carregamento do modelo Nemotron-H. A atualização protege contra um erro de divisor zero que ocorria quando o loop de cauda NextN/MTP derivava o tamanho FFN do especialista a partir de arrays por camada contendo valores zero para camadas não MoE.
- Corrige a falha SIGFPE relatando metadados malformados em vez de dividir por zero quando expert_feed_forward_length está ausente.
- Fornece binários para macOS (Apple Silicon e Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, OpenCL, Vulkan, OpenVINO, SYCL, ROCm) e openEuler.
Esta alteração impede que o aplicativo morra com um erro de sinal durante o carregamento do checkpoint, garantindo operação estável para modelos com camadas MoE e densas misturadas.