Proyek llama.cpp merilis build b11026, yang memperkenalkan perubahan untuk melewati gate_up_exps ketika flag TENSOR_SKIP ditetapkan. Modifikasi ini secara khusus diperlukan untuk model Qwen35MoE di mana tensor MTP digabungkan tetapi tidak dimuat.

Rilis ini menyediakan biner dan framework untuk macOS (Apple Silicon dan Intel), iOS, Linux (CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, SYCL), Android, Windows (CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm 10.0), dan openEuler.

Pembaruan ini memastikan kompatibilitas dengan konfigurasi Qwen35MoE tertentu dengan menangani tensor MTP yang digabungkan tetapi tidak dimuat dengan benar.