llama.cpp 프로젝트가 빌드 b10237을 출시하여 DeepSeek V3.2 모델에 대한 멀티 토큰 예측(MTP) 지원을 도입했습니다.

  • 이 업데이트는 llama 프레임워크 내에서 DeepSeek V3.2에 대해 MTP 기능을 활성화합니다.
  • 모델 유형 발견 로직이 조정되어 탐지 과정에서 MTP 레이어를 명시적으로 포함할 필요가 없게 되었습니다.
  • macOS(Apple Silicon 및 Intel), iOS, Linux(CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows(CPU, CUDA 12/13, Vulkan, OpenCL, OpenVINO, SYCL, HIP) 및 openEuler용 바이너리가 제공됩니다.

이 릴리스를 통해 사용자는 다양한 하드웨어 아키텍처와 운영 체제에서 DeepSeek V3.2와 MTP를 활용할 수 있습니다.