llama.cpp 프로젝트가 빌드 b11048을 출시하여 qwen4exp에서 사용하는 새로운 DSV4 HC 연산 변형의 지원을 도입했습니다. 이 업데이트에는 요소별 시그모이드 게이트가 있는 hc_pre와 동일 혼합이 있는 hc_post에 대한 구체적인 구현이 포함됩니다.

  • 요소별 시그모이드 게이트가 있는 qwen4exp hc_pre 지원 (게이트된 변형)
  • 동일 혼합이 있는 qwen4exp hc_post 지원 (comb == nullptr)
  • CPU, GPU 및 CUDA, ROCm, OpenVINO와 같은 전용 백엔드를 포함한 macOS, Linux, Windows, Android, openEuler용 새 바이너리 제공.

이 릴리스를 통해 사용자는 이러한 특정 하드웨어 가속 연산을 사용하는 모델을 광범위한 지원 플랫폼에서 실행할 수 있습니다.