O projeto llama.cpp lançou a compilação b10232, que introduz suporte para as hiperconexões do DeepSeek V4 por meio do backend do Metal. Esta atualização adiciona a implementação das operações GGML_OP_DSV4_HC_COMB, GGML_OP_DSV4_HC_PRE e GGML_OP_DSV4_HC_POST.
- Os novos kernels utilizam otimizações de registro SIMDgroup e embaralhamento.
- Foi adicionada a infraestrutura de despacho do Metal para suportar contagens de iteração Sinkhorn de produção e larguras de embedding.
- Binários pré-compilados estão disponíveis para macOS (Apple Silicon e Intel), iOS, Linux, Windows, Android e openEuler em vários backends de hardware, incluindo CPU, CUDA, ROCm, Vulkan e OpenVINO.
Este lançamento permite a inferência eficiente de modelos DeepSeek V4 em dispositivos Apple Silicon usando o framework Metal.