Le projet llama.cpp a publié la version b10237, qui introduit le support de la Prédiction Multi-Tokens (MTP) pour le modèle DeepSeek V3.2.

  • La mise à jour active les capacités MTP spécifiquement pour DeepSeek V3.2 au sein du framework llama.
  • La logique de découverte du type de modèle a été ajustée afin que les couches MTP n'aient pas besoin d'être incluses explicitement lors du processus de détection.
  • Des binaires sont fournis pour macOS (Apple Silicon et Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenCL, OpenVINO, SYCL, HIP) et openEuler.

Cette version permet aux utilisateurs de tirer parti de MTP avec DeepSeek V3.2 sur une large gamme d'architectures matérielles et de systèmes d'exploitation.