Proyek llama.cpp merilis build b10232, yang memperkenalkan dukungan untuk hiper-koneksi DeepSeek V4 melalui backend Metal. Pembaruan ini menambahkan implementasi operasi GGML_OP_DSV4_HC_COMB, GGML_OP_DSV4_HC_PRE, dan GGML_OP_DSV4_HC_POST.
- Kernel baru memanfaatkan optimisasi register SIMDgroup dan shuffle.
- Plumbing dispatch Metal ditambahkan untuk mendukung hitungan iterasi Sinkhorn produksi dan lebar embedding.
- Binari pra-bangun tersedia untuk macOS (Apple Silicon dan Intel), iOS, Linux, Windows, Android, dan openEuler di berbagai backend perangkat keras termasuk CPU, CUDA, ROCm, Vulkan, dan OpenVINO.
Rilis ini memungkinkan inferensi model DeepSeek V4 yang efisien pada perangkat Apple Silicon menggunakan framework Metal.