Proyek llama.cpp merilis versi b10947, yang mengatasi crash kritis saat pemuatan model Nemotron-H. Pembaruan ini melindungi dari kesalahan pembagi nol yang terjadi ketika loop ekor NextN/MTP menurunkan ukuran FFN ahli dari array per-layer yang berisi nilai nol untuk layer non-MoE.
- Memperbaiki crash SIGFPE dengan melaporkan metadata yang tidak valid alih-alih membagi dengan nol saat expert_feed_forward_length hilang.
- Menyediakan biner untuk macOS (Apple Silicon dan Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, OpenCL, Vulkan, OpenVINO, SYCL, ROCm), dan openEuler.
Perubahan ini mencegah aplikasi mati dengan kesalahan sinyal selama pemuatan checkpoint, memastikan operasi stabil untuk model dengan lapisan MoE dan padat yang bercampur.