llama.cpp 프로젝트는 Metal 백엔드를 통해 DeepSeek V4 하이퍼커넥션 지원을 도입한 빌드 b10232를 출시했습니다. 이 업데이트에는 GGML_OP_DSV4_HC_COMB, GGML_OP_DSV4_HC_PRE 및 GGML_OP_DSV4_HC_POST 연산의 구현이 추가되었습니다.

  • 새로운 커널은 SIMDgroup 레지스터 및 셔플 최적화를 활용합니다.
  • 프로덕션 Sinkhorn 반복 횟수와 임베딩 너비를 지원하기 위해 Metal 디스패치 파이프라인이 추가되었습니다.
  • CPU, CUDA, ROCm, Vulkan 및 OpenVINO을 포함한 다양한 하드웨어 백엔드에서 macOS (Apple Silicon 및 Intel), iOS, Linux, Windows, Android 및 openEuler용 사전 빌드된 바이너리를 사용할 수 있습니다.

이 릴리스는 Metal 프레임워크를 사용하여 Apple Silicon 장치에서 DeepSeek V4 모델의 효율적인 추론을 가능하게 합니다.