Le projet llama.cpp a publié la compilation b10232, qui introduit le support des hyper-connexions DeepSeek V4 via le backend Metal. Cette mise à jour ajoute l'implémentation des opérations GGML_OP_DSV4_HC_COMB, GGML_OP_DSV4_HC_PRE et GGML_OP_DSV4_HC_POST.
- Les nouveaux kernels utilisent les optimisations de registre SIMDgroup et de mélange.
- Le mécanisme de dispatch Metal a été ajouté pour prendre en charge les comptes d'itération Sinkhorn de production et les largeurs d'embedding.
- Des binaires précompilés sont disponibles pour macOS (Apple Silicon et Intel), iOS, Linux, Windows, Android et openEuler sur divers backends matériels, y compris CPU, CUDA, ROCm, Vulkan et OpenVINO.
Cette version permet une inférence efficace des modèles DeepSeek V4 sur les appareils Apple Silicon en utilisant le framework Metal.