llama.cpp 프로젝트가 버전 b11122를 출시했으며, 여기에는 SYCL 백엔드에 대한 중요한 업데이트가 포함되어 있습니다. 이번 릴리스는 혼합 양자화 유형을 지원하도록 MMVQ GLU 융합을 확장하고 rms_norm+scale 및 ssm_conv+silu 연산에 대한 새로운 융합을 도입합니다.

  • SYCL 백엔드에서 혼합 양자화 유형을 처리하도록 MMVQ GLU 융합을 확장합니다.
  • SYCL을 위한 rms_norm+scale 및 ssm_conv+silu 융합을 추가합니다.
  • 간격 문제를 수정하고 매크로를 템플릿 함수로 변환합니다.
  • CUDA, Vulkan, ROCm, OpenVINO를 포함한 CPU, GPU, NPU 백엔드에 대해 macOS, Linux, Windows, Android, openEuler용 바이너리를 제공합니다.

이 업데이트는 llama.cpp 생태계 내에서 SYCL 기반 하드웨어 가속의 성능과 호환성을 향상시킵니다.