llama.cpp 프로젝트는 TENSOR_SKIP 플래그가 설정되어 있을 때 gate_up_exps 를 건너뛰도록 하는 변경 사항을 도입한 빌드 b11026 을 출시했습니다. 이 수정은 MTP 텐서가 융합되었지만 로드되지 않은 Qwen35MoE 모델에 특히 필요합니다.
이 릴리스는 macOS(Apple Silicon 및 Intel), iOS, Linux(CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, SYCL), Android, Windows(CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm 10.0) 및 openEuler 에 대한 바이너리 및 프레임워크를 제공합니다.
이 업데이트는 융합되었지만 로드되지 않은 MTP 텐서를 올바르게 처리하여 특정 Qwen35MoE 구성과의 호환성을 보장합니다.